구글이 음성 인공지능(AI) 상호작용의 새로운 지평을 열 두 가지 최신 모델, '제미니 3.8 라이브(Gemini 3.8 Live)'와 '제미니 3.8 라이브 확장 사고(Gemini 3.8 Live Extended Thinking)'를 공개했습니다. 이 모델들은 실시간 대화와 복잡한 추론 능력을 대폭 강화하여, 사용자가 AI와 음성으로 소통할 때 훨씬 더 유연하고 지능적인 경험을 제공하는 데 중점을 둡니다.
제미니 3.8 라이브는 빠른 응답과 비용 효율성을 목표로 하며, 대화 지능과 시각 정보 처리 능력을 결합하여 실시간으로 시각적 맥락을 이해하고 대화에 활용합니다. 예를 들어, 화면에 보이는 내용을 기반으로 질문에 답하거나 지시를 따를 수 있습니다. 반면, 제미니 3.8 라이브 확장 사고는 고도의 복잡한 작업을 위해 설계되어, 여러 단계의 추론이 필요한 작업을 대화 흐름을 끊지 않고 동시에 처리할 수 있습니다. 이 모델은 '잠시 확인해 볼게요'와 같은 자연스러운 언어적 신호를 사용하여 백그라운드 작업 진행 상황을 사용자에게 알려주며, 마치 사람과 대화하는 듯한 경험을 제공합니다. 실제 벤치마크에서도 높은 성능을 기록하며 음성 비서 분야에서 선두를 달리고 있습니다.
이러한 발전은 AI 음성 비서가 단순한 명령 수행을 넘어, 진정한 대화 파트너로 진화하고 있음을 시사합니다. 개발자와 기업은 제미니 라이브 API(Gemini Live API)를 통해 이 강력한 기능을 자신들의 서비스에 통합할 수 있으며, 구글 워크스페이스(Google Workspace)와 구글 검색(Google Search)에서도 더욱 직관적이고 협업적인 음성 기반 상호작용을 경험할 수 있게 됩니다. 이는 고객 서비스, 교육, 생산성 도구 등 다양한 분야에서 음성 AI의 활용 가능성을 크게 확장할 것으로 기대됩니다.
