Anthropic, 「Claude Opus 5」 출시
Anthropic이 최신 모델 「Claude Opus 5」를 공개했다. 동사의 최상위 모델 「Claude Fable 5」에 근접한 성능을 절반의 비용으로 제공하며, 여러 벤치마크에서 Fable 5를 상회하는 결과를 기록했다. 가격은 Opus 4.8에서 동결되었으며, Claude Max 및 Claude Pro의 기본 모델로 설정되었다.

Anthropic이 새로운 인공지능 모델 「Claude Opus 5」를 공개했다. 동사에 따르면 이 모델은 최상위 모델 「Claude Fable 5」에 근접한 성능을 가지면서도 비용은 절반 수준으로 억제되었다고 한다. 가격은 100만 토큰 입력당 5달러, 출력당 25달러이며, 이전 세대의 Opus 4.8에서 동결되었다. 출시와 동시에 Anthropic의 모든 플랫폼에서 이용 가능하게 되었으며, 프리미엄 개인용 플랜인 「Claude Max」의 기본 모델로 설정되었다.
인공지능 경쟁은 지금까지 「얼마나 똑똑한가」라는 순수한 성능 비교가 중심이었다. 그러나 기업들이 실제 업무에 인공지능을 통합하게 되면서, 「동등한 품질을 더 저렴하게, 더 광범위하게 사용할 수 있는가」라는 경제적 합리성이 판단의 축이 되어가고 있다. Anthropic이 Opus 5를 「비용 효율적인 실용 모델」로 위치지은 것은 이러한 시장 변화에 대응한 움직임으로 볼 수 있다. 동사는 최전선의 성능을 경쟁하기보다는, 기업이 일상 업무에서 가장 많이 처리하는 「어렵지도 쉽지도 않은」 작업 대역에서 우위를 주장하고 있다.
Anthropic은 모델 라인업을 4단계로 정리했다. Fable 5는 며칠 단위로 작동하는 대규모 자율형 프로젝트용, Opus 5는 코딩이나 지식 노동 등 복잡한 일상 업무용, Sonnet 5는 속도와 비용이 우선되는 대량 처리용, Haiku 4.5는 서브에이전트(인공지능의 보조 역할)나 즉각적인 응답용으로 지정된다. 이를 통해 용도에 따라 모델을 구분해 사용하는 체계가 명확해졌다.
벤치마크(성능 평가 지표) 결과에서는 여러 항목에서 Opus 5가 두드러진 수치를 보여주고 있다. 인공지능 에이전트가 터미널에서 코딩을 수행하는 평가 「Frontier-Bench v0.1」에서는 43.3%의 스코어를 기록했으며, 이는 이전 세대의 Opus 4.8(18.7%)의 2배 이상이며, Fable 5(33.7%)까지도 상회했다. 또한 PC 조작 자동화를 평가하는 「OSWorld 2.0」에서는 Fable 5의 최고 스코어를 초과하는 결과를 Fable 5의 3분의 1 강 수준의 비용으로 달성했다고 전해진다. 새로운 문제 해결 능력을 측정하는 「ARC-AGI 3」에서도 차점 모델의 3배 스코어를 기록했다고 Anthropic은 밝혔다.
한편 Anthropic 자신이 모델의 한계에 대해서도 솔직하게 인정하고 있다는 점은 주목할 가치가 있다. 사이버보안 작업이나 생물학 연구 분야에서는 경합사 모델에 뒤떨어진다는 점, 특정 에이전트형 코딩 평가에서는 다른 회사의 모델이 선도하고 있다는 점을 동사가 밝혔다. 또한 벤치마크는 「특정 결과를 가진 유한한 작업」에는 강한 반면, 장시간에 걸친 지속적인 작업 평가에는 적합하지 않다고도 밝혔으며, 스코어만으로는 포착할 수 없는 측면이 있음을 시사했다.
이러한 자기공개는 인공지능 업계 전체에서 벤치마크 경쟁에 대한 회의가 높아지는 가운데서의 움직임으로 해석할 수 있다. 수치의 과시보다 실제 용도와의 적합성을 솔직하게 전달함으로써 엔터프라이즈(기업) 고객의 신뢰를 얻으려는 자세로도 위치지을 수 있다. 특히 기업 도입 현장에서는 극도로 어려운 작업보다 일상적인 업무의 처리 효율이 의사결정의 열쇠를 쥐는 경우가 많으며, Opus 5의 소구점이 그곳과 일치하고 있다.
인공지능 모델의 진화는 단순한 「성능의 높이」에서 「비용과 성능의 균형」으로 평가 축이 이행하는 단계에 진입했다고 볼 수 있다. Anthropic이 이번에 보여준 것은 최전선의 성능과 실용적인 비용을 양립시키는 모델 설계의 방향성이며, 향후 기업용 인공지능 시장에서 이 설계 사상이 얼마나 수용될지가 다음 초점이 될 것이다.
본 기사는 AI issue 편집부가 사실(fact)을 바탕으로 독자적으로 작성·편집한 저작물입니다. 저작권은 AI issue에 있으며, 무단 전재·재배포 및 AI 학습·활용을 금합니다.