구글의 제미나이 3.8 라이브 모델 공개
구글이 음성 대화형 인공지능 시장을 겨냥해 제미나이 3.8 라이브와 3.8 라이브 익스텐디드 싱킹 모델을 선보였습니다. 웹소켓 API를 활용한 실시간 음성 상호작용 기능을 지원하며, 개발 생태계의 접근성을 높였습니다.
주장구글이 새롭게 선보인 제미나이 3.8 라이브와 3.8 라이브 익스텐디드 싱킹 모델은 음성 대화형 인공지능 시장의 새로운 표준을 제시합니다.
팩트구글은 음성 대 음성 모델 두 가지를 공식 출시했습니다.
팩트이 모델들은 오픈에이아이의 지피티 라이브 제품군과 유사한 형태의 실시간 대화 기능을 제공합니다.
팩트이번 모델은 웹소켓 엔드포인트인 wss://generativelanguage.googleapis.com/ws/google.ai.generativelanguage.v1alpha.GenerativeService.BidiGenerateContent를 통해 연결됩니다.
팩트개발자들은 이 엔드포인트를 활용해 브라우저 환경에서 음성 대화 기능을 직접 구현합니다.
팩트웹 오디오 에이피아이의 오디오 컨텍스트를 사용하여 음성 데이터 캡처와 재생을 동시에 처리합니다.
팩트별도의 외부 라이브러리 없이 웹 브라우저에서 인공지능과 실시간으로 대화하고 응답을 중단시키는 기능을 구현합니다.
주장이번 기술 공개는 인공지능 모델의 접근성을 크게 향상시켰습니다.
교차검증실시간 음성 대화 모델은 네트워크 지연 시간이나 마이크 입력 환경에 따라 성능 차이가 발생할 수 있습니다.
팩트제미나이 라이브는 사용자가 답변 도중 말을 가로채어 대화 흐름을 즉시 변경하는 인터럽트 기능을 지원합니다.
주장제미나이 3.8 라이브 익스텐디드 싱킹 모델은 더 깊은 사고 과정을 거쳐 답변을 생성합니다.
팩트구글은 개발자를 위해 제미나이 라이브 웹소켓 에이피아이 사용법에 관한 공식 튜토리얼을 제공합니다.
출처사이먼 윌리슨의 블로그(https://simonwillison.net/2026/Sep/15/gemini-live/) 및 구글 제미나이 에이피아이 문서(https://ai.google.dev/gemini-api/docs/live-api/get-started-websocket)의 내용을 교차 검증했습니다.
주제
관련 콘텐츠
본 기사는 전문가의 분석과 공개 자료를 기반으로 AI가 작성 후 다른 AI의 검증을 거쳐 작성됐으며 정보의 정확성과 완전성을 보장하지 않습니다. 기사 내용은 특정 투자·의사결정의 권유가 아니며, Wittgenhaus는 이를 근거로 한 행위의 결과에 책임을 지지 않습니다.

