앤스로픽, 클로드 오퍼스 5 출시와 성능 효율화
앤스로픽이 신규 인공지능 모델 클로드 오퍼스 5를 공개했습니다. 이전 모델 대비 성능 효율을 높이고 비용 부담을 줄인 점이 특징입니다. 주요 벤치마크 결과와 기술적 특징을 정리합니다.
주장앤스로픽은 신규 모델 클로드 오퍼스 5가 기존 플래그십 모델인 페이블 5에 근접하는 성능을 구현하면서도 토큰 비용을 절반 수준으로 낮췄다고 발표했습니다. 이는 지피티-5.6 솔 및 중국 경쟁사들의 가격 압박에 대응하기 위한 전략적 결정입니다.
팩트오퍼스 5의 입력 토큰 가격은 백만 개당 5달러, 출력 토큰은 백만 개당 25달러로 책정되었습니다. 이는 이전 모델인 오퍼스 4.8과 동일한 가격 구조를 유지하면서도 성능 효율을 극대화한 결과입니다.
팩트새로운 모델은 에이알씨-에이지아이-3(ARC-AGI-3) 벤치마크에서 30.2퍼센트의 점수를 기록했습니다. 이는 지피티-5.6 솔의 7.8퍼센트 대비 약 4배 높은 수치로, 모델이 새로운 문제를 해결하는 능력에서 비약적인 발전을 이루었음을 나타냅니다.
교차검증모든 영역에서 오퍼스 5가 우세한 것은 아닙니다. 딥스위 v1.1을 통한 에이전트 코딩 테스트에서는 지피티-5.6 솔이 72.7퍼센트로 1위를 차지했으며, 오퍼스 5는 68.8퍼센트로 그 뒤를 이었습니다.
팩트오퍼스 5는 사용자가 성능과 토큰 사용량을 조절할 수 있도록 5단계의 노력 설정 기능을 제공합니다. 앤스로픽은 코딩 및 에이전트 작업 시 가장 높은 설정인 엑스하이 단계를 권장합니다.
주장오퍼스 5는 스스로 작업을 검토하고 반복을 통해 개선하는 능력을 향상했습니다. 특히 필요한 경우 스스로 코드를 작성하여 도구를 구축하는 능력을 갖추어 복잡한 문제 해결에 강점을 보입니다.
팩트사이버 보안 분야에서 오퍼스 5의 보안 필터는 페이블 5보다 약 85퍼센트 덜 빈번하게 작동합니다. 앤스로픽은 이를 통해 사용자의 연구 편의성을 높이면서도 악용 가능성을 차단하는 균형을 맞추고자 했습니다.
교차검증오퍼스 5는 최대 노력 설정에서 오히려 두 번째로 높은 설정보다 낮은 점수를 기록하는 현상이 일부 벤치마크에서 발견되었습니다. 이는 모델의 최적화 과정에서 발생할 수 있는 비효율성을 보여줍니다.
팩트앤스로픽은 오퍼스 5와 함께 대화 중 도구 변경 기능과 자동 대체 모델 전환 기능을 베타로 출시했습니다. 이러한 기능은 개발자가 프롬프트 캐시를 유지하면서도 유연하게 작업을 수행하도록 돕습니다.
주장이번 모델은 단순한 성능 향상을 넘어 실무 환경에서의 비용 효율성을 강조합니다. 개발자들은 이를 통해 복잡한 에이전트 작업을 보다 경제적으로 수행할 수 있습니다.
주장앤스로픽의 이러한 행보는 인공지능 시장 내 점유율 확대를 위한 포석으로 해석됩니다. 기술적 우위와 가격 경쟁력을 동시에 확보하려는 의도가 뚜렷합니다.
출처앤스로픽의 클로드 오퍼스 5 출시와 관련한 기술적 사양 및 벤치마크 데이터는 더 디코더(The Decoder)의 보도를 통해 교차 검증했습니다. (https://the-decoder.com/anthropic-claims-its-new-claude-opus-5-delivers-near-fable-5-performance-at-half-the-token-price/)
본 기사는 전문가의 분석과 공개 자료를 기반으로 AI가 작성 후 다른 AI의 검증을 거쳐 작성됐으며 정보의 정확성과 완전성을 보장하지 않습니다. 기사 내용은 특정 투자·의사결정의 권유가 아니며, Wittgenhaus는 이를 근거로 한 행위의 결과에 책임을 지지 않습니다.

