앤스로픽, Claude Opus 5 공개
AI 요약
- •앤스로픽이 Fable 5급 성능을 절반 비용으로 제공하는 Claude Opus 5를 발표했다
- •코딩·에이전트·지식 작업 평가에서 SOTA를 기록했고 자기검증·반복개선 능력이 크게 향상됐다
- •Artificial Analysis 인텔리전스 지수 61점으로 Fable 5와 사실상 공동 1위, 작업당 비용은 26% 저렴하다
뉴스 기사
앤스로픽이 차세대 대형언어모델 Claude Opus 5를 공식 발표했다. 핵심은 최상위 모델 Claude Fable 5에 근접한 성능을 절반 수준의 비용으로 구현했다는 점이다. 이 모델은 Claude Max의 기본 모델이자 Claude Pro의 최고 성능 옵션으로 제공된다. API 요금은 100만 토큰당 인풋 5달러, 아웃풋 25달러로 기존 Opus 4.8과 동일하게 책정됐다. 또한 대화 도중 도구를 변경하거나 API 자동 폴백을 지원하는 기능을 베타로 선보였으며, 추론 강도는 Low부터 Max까지 5단계로 조절할 수 있다. 성능 면에서는 Frontier-Bench, GDPval-AA, CursorBench 등 코딩·지식 작업 평가에서 최고 수준을 기록했고, ARC-AGI 3, AutomationBench, OSWorld 2.0 등에서도 경쟁 모델을 앞서는 성능과 비용 효율을 보였다. 특히 스스로 결과를 검증하고 반복적으로 개선하는 능력이 크게 향상돼 3D 모델 복원, 오픈소스 버그의 근본 원인 수정, 거래소 데이터 피드 구축 같은 실제 과제에서 높은 에이전트 수행력을 입증했다. 안전성 측면에서도 진전이 있었다. 생명과학 평가에서 이전 세대인 Opus 4.8을 전반적으로 상회했고, 정렬성은 역대 Claude 모델 중 가장 높은 수준으로 평가됐다. 다만 공격적 사이버보안과 생명과학 위험 능력은 여전히 경쟁 모델 Mythos 5보다 낮으며, 취약점 탐지는 가능하지만 익스플로잇 생성은 제한된다고 설명했다. 외부 평가기관 Artificial Analysis의 인텔리전스 지수에서는 61점을 기록해 Fable 5(60점)와 사실상 공동 1위에 올랐으며, GPT-5.6 Sol(59점)과 Kimi K3(57점)를 앞섰다. 평균 작업당 비용은 2.03달러로 Fable 5(2.75달러) 대비 약 26% 저렴해 성능과 비용 효율을 동시에 확보했다는 평가다.
AI 투자 인사이트
최상위급 성능과 저비용을 동시에 달성한 Opus 5는 AI 에이전트 상용화를 가속하며, 관련 인프라·반도체 수요 확대에 긍정적이다.