OpenAIs Chat, en populær AI-chatbot, har nu lært at tale ved hjælp af talesprog, ligesom Siri og Alexa, der markerer et betydeligt spring i AI-kommunikation.
Med denne nye udvikling kan brugerne interagere med chat via stemmeinteraktion, hvilket gør det mere tilgængeligt og alsidigt. Den San Francisco-baserede AI-startup, OpenAI, lancerede for nylig denne version af chatbotten og flytter dermed grænserne for AI-kommunikation.
Som en nyhed kan Chat nu reagere på billeder. For eksempel kan brugere uploade et billede af deres køleskabs indre, og chatbotten kan foreslå potentielle retter baseret på de tilgængelige ingredienser. Denne innovative funktion har til formål at gøre Chat mere brugervenlig og gavnlig.
OpenAI har hurtigt udvidet sine AI-værktøjer. De har for nylig afsløret en version af deres DALL-E-billedgenerator og integreret den i Chat. Siden lanceringen i november har Chat tiltrukket hundredvis af millioner af brugere og inspireret lignende tjenester fra andre virksomheder.
Den nye bot overgår sine rivaler som Google Bard, samtidig med at den udfordrer veletablerede teknologier som Alexa og Siri. Disse digitale assistenter har traditionelt muliggjort interaktion med enheder via stemmen. Nyere chatbots som Chat og Google Bard kan dog prale af overlegne sprogfærdigheder, der gør dem i stand til at generere e-mails, skrive digte og diskutere næsten ethvert emne øjeblikkeligt.
OpenAIs seneste tilbud kombinerer effektivt disse to kommunikationsmetoder. Virksomheden ser tale som en mere intuitiv måde at interagere med sin chatbot på. De hævder, at Chats syntetiske stemmer, der er tilgængelige i fem forskellige indstillinger, overstråler dem, der bruges med populære digitale assistenter.
Den nye chatbot vil være tilgængelig for alle abonnenter på Chat Plus, en tjeneste der koster $20 om måneden, inden for de næste to uger. Botten kan dog kun svare med stemmen, når den bruges på iPhones, iPads og Android-enheder.
Selvom Chats stemmegrænseflade måske minder brugerne om tidligere assistenter, er teknologien bag den fundamentalt anderledes. Den er primært drevet af en stor sprogmodel (LLM), der genererer sprog ved at analysere enorme mængder tekst fra hele internettet.
Chat kan svare på stort set ethvert spørgsmål på få sekunder, i modsætning til ældre digitale assistenter som Alexa og Siri, der kun kunne udføre et begrænset antal opgaver eller besvare en begrænset liste af programmerede spørgsmål.
I takt med at OpenAI udvikler Chat til noget, der minder om Alexa eller Siri, transformerer virksomheder som Amazon og Apple deres digitale assistenter, så de ligner Chat.
Amazon har for nylig forhåndsvist et opdateret Alexa-system, der sigter mod en mere flydende samtale om "ethvert emne", delvist drevet af en ny LLM. I mellemtiden har Apple testet en prototype af sin LLM til fremtidige produkter, ifølge insidere.
Den nye Chat kan også reagere på billeder, når den bruges via nettet samt på iPhone, iPad og Android-enheder. Denne funktion kan vise sig at være uvurderlig for synshandicappede brugere.
OpenAI demonstrerede oprindeligt dette billedværktøj i foråret, men forsinkede dets offentlige udgivelse, indtil de bedre forstod dets potentielle misbrug. For eksempel var der bekymring for, at det kunne tjene som en ansigtsgenkendelsestjeneste, der bruges til hurtigt at identificere personer på billeder.
På trods af disse fremskridt har botten stadig områder til forbedring. For eksempel kan den kæmpe med homonymer, men den kan rette sig selv og demonstrere bottens avancerede indlæringsevner.
Afslutningsvis markerer OpenAIs seneste version af Chat et betydeligt spring inden for AI-kommunikation og tilbyder forbedret brugerinteraktion og alsidighed. I takt med at AI fortsætter med at udvikle sig, bliver det interessant at se, hvordan giganter som Amazon og Apple reagerer på disse fremskridt.