OpenAI lanserer Deep Research: AI-drevet flertrinns internettanalyse

Februar 7, 2025

OpenAI har annonsert lanseringen av Deep Research, en banebrytende AI-agent utviklet for å utføre flertrinnsforskning på internett. Denne nye funksjonen, tilgjengelig i Chat, lar brukere avlaste komplekse nettbaserte forskningsoppgaver og syntetisere enorme mengder informasjon på få minutter.

Bygget på en avansert versjon av den kommende OpenAI o3-modellen, utmerker Deep Research seg innen dataanalyse, kunnskapssyntese og nettbasert resonnement. Modellen søker uavhengig, analyserer og samler data, og produserer rapporter på forskningsanalytikernivå med tydelige sitater og referanser.

Funksjonen er for øyeblikket tilgjengelig for Chat Pro-brukere, og Plus- og Team-brukere får tilgang neste gang.

Hvorfor OpenAI utviklet dyp forskning

Deep Research ble bygget for fagfolk og forskere som krever dybdekunnskap på tvers av felt som finans, vitenskap, politikk og ingeniørfag. Verktøyet er også designet for forbrukere som søker hyper-personlige anbefalinger, noe som gjør det til en verdifull ressurs for grundige produktsammenligninger på kjøp som biler, apparater og teknologi.

I motsetning til tradisjonelle AI-modeller som gir korte oppsummeringer, er Deep Research i stand til:

  • Bla gjennom og analysere hundrevis av nettkilder
  • Generer godt dokumenterte rapporter
  • Tilby strukturerte sitater for faktaverifisering
  • Syntetiserer ikke-intuitiv og vanskelig å finne innsikt

Denne fremgangen representerer et stort skritt mot OpenAIs langsiktige mål om Artificial General Intelligence (AGI), som inkluderer muligheten til å generere ny kunnskap i stedet for bare å hente eksisterende data.

Hvordan dyp forskning fungerer

Brukere kan aktivere dypundersøkelser i chatten ved å velge alternativet «Dypundersøkelser» i meldingsskriveren. Etter å ha lagt inn en forespørsel, for eksempel en konkurranseanalyse av strømmetjenester eller en rapport om trender innen elbilbruk, starter AI-en en grundig undersøkelse.

Viktige funksjoner:

  • Flertrinnsforskning: Deep Research planlegger og utfører autonomt komplekse forskningsbaner, justerer basert på sanntidsfunn.
  • Støtte for filer og regneark: Brukere kan laste opp filer eller regneark for å forbedre kontekstuell forståelse.
  • Direkte sporing: Et sidefelt gir oppdateringer om forskningstrinn, kilder brukt og analysefremgang.
  • Omfattende rapporterInnen 5 til 30 minutter leverer Chat en detaljert forskningsrapport, komplett med sitater.
  • Kommende forbedringer: Fremtidige oppdateringer vil introdusere innebygde bilder, datavisualiseringer og analytiske grafer for å forbedre rapporter.

I motsetning til GPT-4o, som utmerker seg i sanntids multimodale interaksjoner, er Deep Research designet for omfattende, domenespesifikke forespørsler som krever grundig faktasjekking og syntese.

Benchmark Performance: En ny standard innen AI-forskning

Deep Research utkonkurrerer tidligere AI-modeller betydelig i forskningsevalueringer på ekspertnivå, og viser overlegen resonnement og nøyaktighet.

Menneskehetens siste eksamensprestasjoner

I Humanity's Last Exam, en streng AI-benchmark-testing av resonnement på ekspertnivå på tvers av 100+ fag, oppnådde Deep Research en rekordhøy nøyaktighet på 26.6 %, og utkonkurrerte alle større AI-modeller.

Modell Nøyaktighet (%)
GPT-4o 3.3
Grok-2 3.8
Claude 3.5 sonett 4.3
Gemini tenkning 6.2
ÅpenAI o1 9.1
DypSeek-R1 9.4
OpenAI o3-mini (høy) 13.0
OpenAI Deep Research 26.6

Deep Research utmerker seg i kjemi, humaniora, samfunnsvitenskap og matematikk, ved å bruke sine avanserte resonneringsevner til å søke og tolke komplekse data mer effektivt enn tidligere modeller.

GAIA benchmark-resultater

Deep Research har også satt en ny toppmoderne (SOTA) rekord på GAIA, en offentlig målestokk som tester AIs evne til å håndtere flertrinns forskningsoppgaver i den virkelige verden.

Testnivå Forrige SOTA (%) Deep Research Pass@1 (%) Deep Research Consensus@64 (%)
Level 1 67.92 74.29 78.66
Level 2 67.44 69.06 73.21
Level 3 42.31 47.6 58.03
Gjennomsnitt 63.64 67.36 72.57

Disse resultatene bekrefter at Deep Research ikke bare er raskere og mer effektiv, men også i stand til å takle svært tekniske forskningsutfordringer med større presisjon.

Utfordringer og fremtidige forbedringer

Til tross for sine avanserte evner, er Deep Research fortsatt i de tidlige stadiene og har noen begrensninger:

  • Fakta Hallusinasjon: Selv om det er betydelig redusert, kan sporadiske feiltolkninger eller unøyaktige slutninger forekomme.
  • Problemer med konfidenskalibrering: Modellen uttrykker kanskje ikke alltid usikkerhet nøyaktig, noe som potensielt kan føre til oversikkerhet i enkelte svar.
  • Formaterings- og sitatfeil: Mindre formateringsinkonsekvenser og problemer med sitatplassering blir avgrenset.

Etter hvert som Deep Research utvikler seg, planlegger OpenAI å forbedre påliteligheten, forbedre nøyaktigheten og utvide tilgangen til flere spesialiserte datakilder.

Tilgjengelighet og tilgang

Hvem kan bruke dyp forskning?

  • Pro-brukere: Tilgjengelig nå, med en grense på 100 søk per måned.
  • Pluss- og teambrukere: Tilgang ruller ut snart.
  • Enterprise-brukere: Fremtidig utgivelse planlagt.

Deep Research er for tiden utilgjengelig i Storbritannia, Sveits og EØS, men OpenAI jobber aktivt med å utvide regional tilgang.

Kommende forbedringer

  • En mer kostnadseffektiv versjon: En mindre, raskere og mer effektiv Deep Research-modell vil snart bli tilgjengelig for alle betalte brukere.
  • Mobil- og skrivebordsintegrasjonDeep Research rulles ut til Chats mobil- og skrivebordsapper i løpet av neste måned.
  • Utvidet datatilgang: Fremtidige oppdateringer vil integrere abonnementsbaserte og interne datakilder, noe som gjør forskningen enda mer omfattende.

Fremtiden for AI-drevet forskning

OpenAIs dype forskning representerer et stort sprang fremover i AIs evne til å gjennomføre uavhengige, flertrinns resonnement. Ved å kombinere intelligent datasyntese, nettsurfing i sanntid og avansert rapportering, baner OpenAI vei for mer autonome AI-drevne forskningsverktøy.

Når vi ser fremover, ser OpenAI for seg enda mer sofistikerte AI-agenter som er i stand til å utføre asynkron nettbasert forskning og utføre oppgaver i den virkelige verden. Integrasjonen av Deep Research med OpenAIs kommende agent, Operator, lover å redefinere AIs rolle innen forskning, automatisering og beslutningstaking.

For nå er Deep Research satt til å revolusjonere hvordan fagfolk, forskere og forbrukere samler inn og syntetiserer informasjon og forvandler timer med arbeid til minutter.