OpenAI o3-mini: Rychlejší a chytřejší AI pro STEM a vývojáře

Února 5, 2025

OpenAI představilo o3-mini, nejnovější model ve své řadě uvažování, navržený tak, aby poskytoval výjimečný výkon v oblastech STEM, softwarového inženýrství a logického řešení problémů. Toto vydání zlepšuje dostupnost umělé inteligence tím, že udržuje nízké náklady a zároveň zlepšuje rychlost a přesnost ve srovnání s jeho předchůdcem, OpenAI o1-mini.

Po předpremiéře v prosinci 2024 je o3-mini nyní oficiálně dostupný v chatu a API službách. Nabízí vyšší kapacitu uvažování, což ho činí ideálním pro úkoly ve vědě, technologii, inženýrství a matematice (STEM). Vývojáři mohou využít volání funkcí, strukturované výstupy a vývojářské zprávy, což zajišťuje větší flexibilitu a aplikace připravené k produkčnímu prostředí.

Vylepšené funkce a usnadnění

Jednou z nejočekávanějších aktualizací OpenAI o3-mini je jeho podpora pro různé úrovně úsilí o uvažování, což uživatelům umožňuje optimalizovat model z hlediska rychlosti nebo složitosti na základě jejich potřeb. Mezi tyto režimy patří:

  • Low Reasoning Effort: Upřednostňuje rychlost s minimálními výpočetními náklady.
  • Střední uvažovací úsilí: Vyvažuje přesnost a dobu odezvy.
  • High Reasoning Effort: Maximalizuje inteligenci pro složité úkoly.

Na rozdíl od OpenAI o1-mini zavádí o3-mini strukturované vyhledávání, které uživatelům umožňuje přístup k aktuálním informacím z relevantních webových zdrojů. Navíc ztrojnásobuje limity zpráv pro uživatele Chat Plus a Team, z 50 na 150 zpráv denně, což zlepšuje přístupnost pro časté uživatele.

OpenAI poprvé zpřístupnila uživatelům bezplatné úrovně v Chatu model uvažování, který jim umožňuje vyzkoušet logické řešení problémů s pomocí umělé inteligence výběrem možnosti „Zdůvodnění“ v editoru zpráv.

Výkonnostní benchmarky: Překonání předchozích modelů

OpenAI o3-mini překonává svého předchůdce, o1-mini, v různých vědecká a matematická měřítka:

Matematika a kódování

  • Matematické uvažování: Přesnost odpovídá OpenAI o1 a zároveň nabízí rychlejší dobu odezvy.
  • Soutěžní matematika (AIME 2024): Překonává o1-mini s velkým úsilím o uvažování.
  • Konkurenční programování Codeforces: Dosahuje vyšší Elo dává gól napříč úrovněmi logického úsilí.
  • Softwarové inženýrství (SWE-Bench): Překonává předchozí modely a vykazuje nejlepší výsledky ve vývoji softwaru s podporou umělé inteligence.

Pokročilé vědecké znalosti

  • Vědecké otázky na úrovni PhD (GPQA Diamond): Vyniká v biologii, chemii a fyzice a dosahuje úrovně výkonu blízké OpenAI o1.
  • Matematika na úrovni výzkumu (FrontierMath): S Integrace nástroje Python, o3-mini úspěšně řeší více než 32 % problémů, počítaje v to 28 % nejnáročnějších (T3) problémů.

Obecné znalosti a lidské preference

  • Hodnocení ukazují a 56 % preferuje odpovědi o3-mini před o1-mini.
  • Snižuje se velké chyby o 39 %, zlepšení spolehlivosti na difficult otázky z reálného světa.

Zlepšení rychlosti a efektivity

OpenAI o3-mini poskytuje odpovědi O 24 % rychlejší než o1-mini, Čímž se snižuje průměrná doba odezvy od 10.16 sekundy do 7.7 sekundy. V testech latence o3-mini udržuje a O 2,500 XNUMX ms rychlejší čas do prvního tokenu, což zajišťuje rychlejší a plynulejší interakce.

Vylepšení bezpečnosti a etický vývoj AI

OpenAI má integrované techniky deliberativního zarovnání, aby zajistila, že o3-mini generuje bezpečné reakce přizpůsobené lidem. Rozsáhlé testování odhalilo, že o3-mini výrazně předčí GPT-4o v hodnocení bezpečnosti, což z něj dělá jeden z nejrobustnějších modelů OpenAI v prevenci zneužití a zneužití útěku z vězení.

Prostřednictvím externího red-teamingu a systematického hodnocení bezpečnosti OpenAI pokračuje ve zmírňování rizik a zároveň optimalizuje inteligenci AI. Nejnovější systémová karta poskytuje přehled o nepovoleném hodnocení obsahu a bezpečnostních protokolech.

Co bude dál pro OpenAI?

S o3-mini udělal OpenAI další významný krok k tomu, aby pokročilé uvažování AI bylo dostupnější a nákladově efektivnější. Tento model je v souladu s pokračující misí společnosti snižovat ceny za token při zachování špičkových schopností uvažování.

S tím, jak se rozšiřuje zavádění umělé inteligence, zůstává OpenAI odhodlána posouvat hranice inteligentních, efektivních a bezpečných modelů umělé inteligence a zajistit, aby podniky, vývojáři a studenti mohli využívat umělou inteligenci pro řešení problémů, inovace a výzkum.

Od dnešního dne je o3-mini k dispozici pro uživatele Chat Plus, Team a Pro, přičemž přístup Enterprise bude spuštěn v únoru. Přístup k API je udělen vybraným vývojářům na úrovních 3–5.

Pro ty, kteří chtějí využít sílu AI ve STEM a vývoji softwaru, představuje OpenAI o3-mini vzrušující skok vpřed.