OpenAI o3-mini: Raskere, smartere AI for STEM og utviklere

Februar 5, 2025

OpenAI har avduket o3-mini, den siste modellen i sin resonneringsserie, designet for å levere eksepsjonell ytelse innen STEM-felt, programvareutvikling og logisk problemløsning. Denne utgivelsen forbedrer AI-tilgjengelighet ved å opprettholde lave kostnader samtidig som den forbedrer hastighet og nøyaktighet sammenlignet med forgjengeren, OpenAI o1-mini.

Etter forhåndsvisning i desember 2024 er o3-mini nå offisielt tilgjengelig i Chat- og API-tjenester. Den tilbyr høyere resonneringskapasitet, noe som gjør den ideell for oppgaver innen vitenskap, teknologi, ingeniørfag og matematikk (STEM). Utviklere kan utnytte funksjonskall, strukturerte utdata og utviklermeldinger, noe som sikrer større fleksibilitet og produksjonsklare applikasjoner.

Forbedrede funksjoner og tilgjengelighet

En av de mest etterlengtede oppdateringene med OpenAI o3-mini er støtten for ulike resonnementinnsatsnivåer, slik at brukerne kan optimalisere modellen for hastighet eller kompleksitet basert på deres behov. Disse modusene inkluderer:

  • Lav resonnementinnsats: Prioriterer hastighet med minimale beregningskostnader.
  • Middels resonnementinnsats: Balanserer nøyaktighet og responstid.
  • Høy resonnementinnsats: Maksimerer intelligensen for komplekse oppgaver.

I motsetning til OpenAI o1-mini introduserer o3-mini strukturerte søkefunksjoner, som lar brukere få tilgang til oppdatert informasjon med relevante nettkilder. I tillegg tredobler den meldingsgrensene for Chat Plus- og Team-brukere, fra 50 til 150 meldinger per dag, noe som forbedrer tilgjengeligheten for hyppige brukere.

For første gang har OpenAI gjort en resonneringsmodell tilgjengelig for brukere av gratisnivå i Chat, slik at de kan oppleve AI-assistert logisk problemløsning ved å velge alternativet «Resonering» i meldingsskriveren.

Ytelsesmål: Overgår tidligere modeller

OpenAI o3-mini overgår forgjengeren, o1-mini, i ulike vitenskapelige og matematiske benchmarks:

Matematikk og koding

  • Matematisk resonnement: Matcher OpenAI o1 i nøyaktighet samtidig som det gir raskere responstider.
  • Konkurransematematikk (AIME 2024): Utkonkurrerer o1-mini med høy resonnementinnsats.
  • Codeforces konkurransedyktig programmering: Oppnår høyere Elo scorer på tvers av resonnementinnsatsnivåer.
  • Programvareteknikk (SWE-benk): Overgår tidligere modeller, og viser de beste resultatene innen AI-assistert programvareutvikling.

Avansert vitenskapelig kunnskap

  • Vitenskapsspørsmål på doktorgradsnivå (GPQA Diamond): Utmerker seg i biologi, kjemi og fysikk, og oppnår ytelsesnivåer nær OpenAI o1.
  • Matematikk på forskningsnivå (FrontierMath): Med Python-verktøyintegrasjon, løser o3-mini vellykket over 32 % av problemene, Herunder 28 % av de mest utfordrende (T3) problemene.

Generell kunnskap og menneskelig preferanse

  • Evalueringer viser en 56 % preferanse for o3-mini-svar fremfor o1-mini.
  • reduserer store feil med 39 %, forbedre påliteligheten på difficult virkelige spørsmål.

Hastighet og effektivitetsforbedringer

OpenAI o3-mini gir svar 24 % raskere enn o1-mini, Redusere gjennomsnittlig responstid fra 10.16 sekunder til 7.7 sekunder. I latenstidstester opprettholder o3-mini en 2,500 ms raskere tid til første token, som sikrer raskere og mer flytende interaksjoner.

Sikkerhetsforbedringer og etisk AI-utvikling

OpenAI har integrerte deliberative alignment-teknikker for å sikre at o3-mini genererer trygge, menneskelige svar. Omfattende testing avslørte at o3-mini overgår GPT-4o betydelig i sikkerhetsevalueringer, noe som gjør den til en av OpenAIs mest robuste modeller for å forhindre misbruk og jailbreak-utnyttelser.

Gjennom ekstern red-teaming og systematiske sikkerhetsevalueringer, fortsetter OpenAI å redusere risikoen samtidig som den optimaliserer AI-intelligens. Det nyeste systemkortet gir innsikt i ikke-tillatte innholdsevalueringer og sikkerhetsprotokoller.

Hva er det neste for OpenAI?

Med o3-mini har OpenAI tatt nok et betydelig skritt mot å gjøre avansert AI-resonnering mer tilgjengelig og kostnadseffektiv. Denne modellen er i tråd med selskapets pågående oppdrag om å redusere prissettingen per token samtidig som den opprettholder resonneringsevner på toppnivå.

Etter hvert som AI-adopsjonen utvides, er OpenAI fortsatt opptatt av å flytte grensene for intelligente, effektive og sikre AI-modeller, og sikre at bedrifter, utviklere og studenter kan utnytte AI for problemløsning, innovasjon og forskning.

Fra og med i dag er o3-mini tilgjengelig for Chat Plus-, Team- og Pro-brukere, og Enterprise-tilgang rulles ut i februar. API-tilgang gis til utvalgte utviklere i nivå 3–5.

For de som ønsker å utnytte kraften til AI i STEM og programvareutvikling, presenterer OpenAI o3-mini et spennende sprang fremover.