인기 있는 AI 챗봇인 OpenAI의 Chat은 이제 말을 사용하여 대화하는 방법을 배웠습니다. 시리 알렉사, AI 커뮤니케이션의 획기적인 도약을 의미합니다.
이 새로운 기능을 통해 사용자는 음성 상호작용을 통해 채팅에 참여할 수 있어 더욱 접근성과 활용도가 높아졌습니다. 샌프란시스코에 본사를 둔 AI 스타트업 OpenAI는 최근 이 버전의 챗봇을 출시하며 AI 소통의 지평을 넓혔습니다.
또 다른 혁신적인 기능으로, Chat에서 이미지에 반응할 수 있게 되었습니다. 예를 들어, 사용자가 냉장고 내부 사진을 업로드하면 챗봇이 사용 가능한 재료를 기반으로 요리 레시피를 제안합니다. 이 혁신적인 기능은 Chat을 더욱 사용자 친화적이고 유용하게 만들기 위한 것입니다.
OpenAI는 AI 도구를 빠르게 확장해 왔습니다. 최근에는 DALL-E 이미지 생성기 버전을 공개하고 Chat에 통합했습니다. 11월 출시 이후 Chat은 수억 명의 사용자를 확보했으며, 다른 회사의 유사 서비스에도 영향을 미쳤습니다.
새로운 챗봇은 구글 바드(Google Bard)와 같은 경쟁사보다 성능이 뛰어나면서도 알렉사(Alexa)와 시리(Siri)와 같은 기존 기술에 도전장을 내밀었습니다. 이러한 디지털 비서들은 전통적으로 음성을 통해 기기와의 상호작용을 지원해 왔습니다. 그러나 챗(Chat)과 구글 바드(Google Bard)와 같은 새로운 챗봇들은 뛰어난 언어 능력을 자랑하며, 이메일을 작성하고, 시를 쓰고, 거의 모든 주제에 대해 즉시 토론할 수 있습니다.
OpenAI의 최신 제품은 이 두 가지 소통 방식을 효과적으로 통합합니다. OpenAI는 음성을 챗봇과 소통하는 더욱 직관적인 방법으로 보고 있습니다. 5가지 옵션으로 제공되는 Chat의 합성 음성은 기존 디지털 비서에서 사용되는 음성보다 뛰어나다고 주장합니다.
새로운 챗봇은 월 20달러의 서비스인 Chat Plus 구독자 모두에게 2주 안에 제공될 예정입니다. 단, iPhone, iPad, Android 기기에서만 음성으로 응답할 수 있습니다.
Chat의 음성 인터페이스는 사용자에게 이전 비서를 떠올리게 할 수 있지만, 이를 구동하는 기술은 근본적으로 다릅니다. Chat은 인터넷 전반에 걸쳐 방대한 양의 텍스트를 분석하여 언어를 생성하는 대규모 언어 모델(LLM)을 기반으로 합니다.
채팅은 몇 초 안에 거의 모든 질문에 답변할 수 있으며, 제한된 수의 작업만 수행하거나 프로그래밍된 질문의 한정된 목록에만 답할 수 있었던 알렉사나 시리와 같은 기존 디지털 비서와는 대조적입니다.
OpenAI가 Chat을 Alexa나 Siri와 비슷한 것으로 발전시키면서 Amazon과 Apple과 같은 회사도 자사의 디지털 비서를 Chat과 비슷하게 바꾸고 있습니다.
Amazon은 최근 부분적으로 새로운 LLM에 의해 주도되는 "모든 주제"에 대해 보다 유동적인 대화를 목표로 하는 업데이트된 Alexa 시스템을 미리 선보였습니다. 한편 내부자에 따르면 애플은 미래 제품을 위한 LLM 프로토타입을 테스트해 왔다.
새로운 채팅은 웹뿐만 아니라 iPhone, iPad, Android 기기에서도 이미지에 반응할 수 있습니다. 이 기능은 시각 장애인 사용자에게 매우 유용할 것으로 예상됩니다.
OpenAI는 처음에 이 이미지 도구를 봄에 시연했지만 잠재적인 오용을 더 잘 이해할 때까지 공개 출시를 연기했습니다. 예를 들어, 사진 속 사람을 빠르게 식별하는 데 사용되는 얼굴 인식 서비스로 사용될 수 있다는 우려가 있었습니다.
이러한 발전에도 불구하고 봇에는 여전히 개선할 부분이 있습니다. 예를 들어, 동음이의어 문제를 해결할 수 있지만 자체적으로 수정하여 봇의 고급 학습 기능을 보여줄 수 있습니다.
결론적으로, OpenAI의 최신 Chat 버전은 향상된 사용자 상호작용과 다재다능함을 제공하며 AI 소통에 있어 큰 도약을 보여줍니다. AI가 계속 발전함에 따라 아마존과 애플 같은 거대 기업들이 이러한 발전에 어떻게 대응할지 지켜보는 것은 흥미로울 것입니다.