구글, 제미나이 3.8 라이브 출시
구글이 인공지능 음성 에이전트 시장에서 경쟁력을 높이기 위해 제미나이 3.8 라이브를 출시했습니다. 신규 모델은 저렴한 가격과 다양한 언어 지원 기능을 제공합니다. 구글은 개발자 생태계 확장을 추진하고 있습니다.
주장구글 딥마인드는 경쟁사인 오픈에이아이의 지피티 라이브 원 모델에 대응하기 위해 제미나이 3.8 라이브와 확장 사고 모델 변형 버전을 공개했습니다. 이번 신규 모델은 응용 프로그램 프로그래밍 인터페이스와 구글 인공지능 스튜디오를 통해 곧바로 제공됩니다.
팩트제미나이 3.8 라이브는 음성 에이전트 기능을 바탕으로 백그라운드에서 응용 프로그램 프로그래밍 인터페이스 호출을 수행합니다. 이 모델은 시각적 정보를 처리하는 동시에 사용자와 대화를 이어갑니다. 전 세계 97개 이상의 언어를 지원하여 글로벌 시장에서의 범용성을 넓혔습니다.
팩트확장 사고 모델 변형 버전은 아티피셜 애널리시스 음성 대 음성 리더보드에서 82.6퍼센트를 기록하며 1위에 올랐습니다. 이는 지피티 라이브 원 모델을 앞서는 수치입니다.
팩트구글은 음성 입력에 분당 0.005달러, 출력에 0.018달러의 비용을 책정했습니다. 이는 지피티 라이브 원의 분당 0.05달러와 비교해 저렴한 수준입니다.
팩트한 시간 분량의 음성 대화를 기준으로 구글 모델은 약 1.38달러의 비용이 발생합니다. 오픈에이아이 모델은 최소 3.00달러 이상의 비용이 소요됩니다.
팩트구글은 개발자들이 신규 모델을 쉽게 테스트하고 구현할 수 있도록 깃허브에 샘플 애플리케이션을 공개했습니다. 개발자들은 제미나이 응용 프로그램 프로그래밍 인터페이스를 활용한 음성 기반 서비스 구축을 즉시 시작할 수 있습니다.
주장이번 출시는 인공지능 음성 에이전트 시장에서 비용 효율성을 중시하는 기업과 개발자들에게 대안을 제시합니다. 구글은 저렴한 가격 정책을 통해 더 많은 개발자를 자사 생태계로 유입시킵니다.
주장음성 인공지능 기술은 단순한 대화를 넘어 시각적 데이터 처리와 실시간 응용 프로그램 프로그래밍 인터페이스 연동으로 진화합니다. 제미나이 3.8 라이브는 복합적인 기능을 저비용으로 구현했다는 점에서 산업적 의미를 갖습니다.
교차검증오픈에이아이의 모델은 양방향 동시 통신 기술을 통해 듣기와 말하기를 동시에 수행하며 자연스러운 대화 경험을 제공합니다. 데모 영상 분석 결과 오픈에이아이 모델의 음질이 더 우수한 것으로 평가되어 구글은 품질보다 가격 최적화에 집중했습니다.
출처더 디코더(https://the-decoder.com/google-launches-gemini-3-8-live-to-take-on-openais-gpt-live-1-at-a-fraction-of-the-cost/) 및 구글의 공식 발표를 교차 검증했습니다.
관련 콘텐츠
본 기사는 전문가의 분석과 공개 자료를 기반으로 AI가 작성 후 다른 AI의 검증을 거쳐 작성됐으며 정보의 정확성과 완전성을 보장하지 않습니다. 기사 내용은 특정 투자·의사결정의 권유가 아니며, Wittgenhaus는 이를 근거로 한 행위의 결과에 책임을 지지 않습니다.

