구글 제미나이 3.8 라이브 확장 사고 모델 공개
구글이 실시간 음성 대화의 성능을 높인 제미나이 3.8 라이브와 확장 사고 모델을 공개했습니다. 이 모델들은 97개 언어 지원과 음성 에이전트 벤치마크 1위를 기록했습니다. 개발자 플랫폼 연동과 워터마크 적용을 통해 상용화 단계에 진입했습니다.
주장구글은 실시간 음성 대화의 자연스러움과 지능을 높이기 위해 제미나이 3.8 라이브와 제미나이 3.8 라이브 확장 사고 모델을 출시했습니다.
팩트제미나이 3.8 라이브 확장 사고 모델은 아티피셜 애널리시스의 음성 대 음성 품질 지수에서 82.6점으로 1위를 기록했습니다.
팩트이 모델은 에이전트 작업 완료 성능 평가인 타우-보이스 벤치마크에서 68.6%, 시에라 뱅킹 벤치마크에서 35.1%의 성과를 보였습니다.
팩트빅 벤치 오디오 테스트에서는 97.7%의 추론 능력을 기록했습니다.
팩트제미나이 3.8 라이브는 97개 언어를 실시간으로 감지하고 대화 도중 언어를 전환합니다.
팩트대화가 진행되는 동안 백그라운드에서 도구 실행과 응용 프로그램 프로그래밍 인터페이스 호출을 수행합니다.
교차검증이번 모델은 복잡한 작업 흐름에서 정확성과 대화 품질 사이의 균형을 맞추는 데 초점을 맞추었습니다.
팩트서비스나우의 평가 결과, 파레토 프런티어를 확장하며 음성 에이전트의 성능을 높였다는 평가를 받았습니다.
주장이번 신규 모델은 개발자와 기업이 신뢰할 수 있는 음성 에이전트를 구축할 수 있는 기반 기술을 제공합니다.
팩트구글은 아고라, 피쉬잼, 랭체인, 라이브킷, 파이프캣, 버셀 등 개발자 플랫폼과 협력하여 제미나이 라이브 응용 프로그램 프로그래밍 인터페이스를 제공합니다.
팩트모든 생성된 오디오 콘텐츠에는 신스아이디 워터마킹 기술이 적용되어 인공지능 생성 콘텐츠를 식별합니다.
팩트제미나이 3.8 라이브와 확장 사고 모델은 제미나이 응용 프로그램 프로그래밍 인터페이스와 구글 인공지능 스튜디오를 통해 개발자에게 제공됩니다.
출처구글 딥마인드 공식 블로그(https://deepmind.google/blog/introducing-gemini-3-8-live-and-3-8-live-extended-thinking/)의 보도를 교차 검증했습니다.
주제
관련 콘텐츠
본 기사는 전문가의 분석과 공개 자료를 기반으로 AI가 작성 후 다른 AI의 검증을 거쳐 작성됐으며 정보의 정확성과 완전성을 보장하지 않습니다. 기사 내용은 특정 투자·의사결정의 권유가 아니며, Wittgenhaus는 이를 근거로 한 행위의 결과에 책임을 지지 않습니다.

