OpenAIs Chat, en populær AI-chatbot, har nå lært å snakke sammen ved hjelp av muntlig språk, omtrent som Siri og Alexa, som markerer et betydelig sprang i AI-kommunikasjon.
Med denne nye utviklingen kan brukere samhandle med chat via stemmekommunikasjon, noe som gjør det mer tilgjengelig og allsidig. Den San Francisco-baserte AI-oppstartsbedriften OpenAI lanserte nylig denne versjonen av chatboten, og flytter dermed grensene for AI-kommunikasjon.
Nok en nyhet er at Chat nå kan svare på bilder. Brukere kan for eksempel laste opp et bilde av kjøleskapets innside, og chatboten kan foreslå potensielle retter basert på tilgjengelige ingredienser. Denne innovative funksjonen har som mål å gjøre Chat mer brukervennlig og nyttig.
OpenAI har raskt utvidet sine AI-verktøy. De avduket nylig en versjon av DALL-E-bildegeneratoren sin og integrerte den i Chat. Siden lanseringen i november har Chat tiltrukket hundrevis av millioner brukere og inspirert lignende tjenester fra andre selskaper.
Den nye boten overgår konkurrentene sine som Google Bard, samtidig som den utfordrer veletablerte teknologier som Alexa og Siri. Disse digitale assistentene har tradisjonelt tilrettelagt samhandling med enheter via stemmen. Nyere chatboter som Chat og Google Bard kan imidlertid skryte av overlegne språkferdigheter, slik at de kan generere e-poster, skrive poesi og diskutere nesten ethvert emne umiddelbart.
OpenAIs nyeste tilbud slår effektivt sammen disse to kommunikasjonsmetodene. Selskapet ser på det å snakke som en mer intuitiv måte å samhandle med chatboten sin på. De hevder at Chats syntetiske stemmer, tilgjengelig i fem forskjellige alternativer, overgår de som brukes med populære digitale assistenter.
Den nye chatboten vil være tilgjengelig for alle abonnenter på Chat Plus, en tjeneste som koster 20 dollar i måneden, innen de neste to ukene. Boten kan imidlertid bare svare med stemme når den brukes på iPhones, iPads og Android-enheter.
Selv om Chats talegrensesnitt kan minne brukere om tidligere assistenter, er teknologien som driver det fundamentalt annerledes. Det er primært drevet av en stor språkmodell (LLM) som genererer språk ved å analysere enorme mengder tekst fra hele internett.
Chat kan svare på så å si alle spørsmål på sekunder, i motsetning til eldre digitale assistenter som Alexa og Siri, som bare kunne utføre et begrenset antall oppgaver eller svare på en begrenset liste med programmerte spørsmål.
Etter hvert som OpenAI utvikler Chat til noe som ligner på Alexa eller Siri, forvandler selskaper som Amazon og Apple sine digitale assistenter til å ligne Chat.
Amazon forhåndsviste nylig et oppdatert Alexa-system som tar sikte på en mer flytende samtale om "hvilket som helst emne", delvis drevet av en ny LLM. I mellomtiden har Apple testet en prototype av sin LLM for fremtidige produkter, ifølge innsidere.
Den nye Chat-funksjonen kan også svare på bilder når den brukes via nettet, så vel som på iPhone, iPad og Android-enheter. Denne funksjonen kan vise seg å være uvurderlig for synshemmede brukere.
OpenAI demonstrerte først dette bildeverktøyet i løpet av våren, men forsinket offentlig utgivelse til de bedre forsto det potensielle misbruket. For eksempel var det bekymring for at det kunne tjene som en ansiktsgjenkjenningstjeneste som brukes til å identifisere personer på bilder raskt.
Til tross for disse fremskritt, har boten fortsatt områder for forbedring. For eksempel kan den kjempe med homonymer, men den kan korrigere seg selv, og demonstrere de avanserte læringsmulighetene til boten.
Avslutningsvis markerer OpenAIs nyeste versjon av Chat et betydelig sprang innen AI-kommunikasjon, og tilbyr forbedret brukerinteraksjon og allsidighet. Etter hvert som AI fortsetter å utvikle seg, blir det interessant å se hvordan giganter som Amazon og Apple reagerer på disse fremskrittene.