Anthropic은 자사의 최상위 Fable 5 모델 가격의 약 절반 가격으로 최전선에 가까운 지능을 제공하는 새로운 AI 모델인 Claude Opus 5를 공개했습니다. 2026년 7월 24일에 출시된 Opus 5는 이제 Claude Max의 기본 모델이자 Claude Pro에서 사용할 수 있는 가장 강력한 모델로, 코딩, 자율 에이전트 및 전문 지식 작업을 위한 Anthropic의 일상적인 도구로 자리매김하고 있습니다.
이번 출시는 기업이 AI 지출을 면밀히 조사하는 순간에 이루어집니다. CNBC에 따르면 새 모델은 "Fable 5와 경쟁하며 기업이 비용에 대해 걱정하기 때문에 더 저렴합니다". 반면 Bloomberg는 "일상 작업에 더 비용 효율적인 모델"이라고 특징지었습니다. 최신 AI 개발을 추적하는 팀의 경우 Opus 5는 다음 경쟁 전장이 원시 벤치마크 패권이 아니라 가치라는 의도적인 내기를 나타냅니다.
벤치마크 성능: 코딩 및 지식 작업에 대한 새로운 최첨단 기술
Anthropic은 Opus 5가 Frontier-Bench 및 GDPval-AA를 포함한 코딩 및 지식 작업 평가에 대한 최첨단 결과를 게시했다고 보고합니다. Frontier-Bench v0.1에서 회사는 Opus 5가 다른 모든 모델을 능가하고 이전 모델인 Opus 4.8보다 성능이 두 배 이상 향상되었으며 작업당 비용이 더 낮다고 밝혔습니다.
Anthropic의 자체 벤치마크에 따르면 CursorBench 3.2에서 Opus 5는 Fable 5의 최고 점수의 0.5% 이내이며 작업당 비용은 절반입니다. Decrypt는 이 모델이 "대부분의 벤치마크에서 절반 가격으로 Fable 5를 능가합니다"라고 언급했습니다.
이점은 에이전트 및 문제 해결 평가로 확장됩니다.
- ARC-AGI 3: Opus 5는 이 새로운 문제 해결 테스트에서 차선책 모델보다 대략 3배 더 높은 점수를 받았습니다.
- Zapier AutomationBench: 동일한 비용으로 차선책 모델보다 약 1.5배 높은 통과율로 엔드투엔드 비즈니스 작업 완료를 측정합니다.
- OSWorld 2.0(컴퓨터 사용): Opus 5는 1/3이 조금 넘는 비용으로 Fable 5의 최고 결과를 능가합니다.
특히 Anthropic은 Opus 5가 "사이버 보안 작업에서 Mythos 5보다 뒤쳐져 있다"는 점을 인정합니다. 이 영역에서는 라이벌 프론티어 모델이 선두를 유지하고 있습니다.
대행사 및 자체 검증 강화
발표에서 반복되는 주제는 자체 작업을 검증하고 성공할 때까지 반복하는 Opus 5의 향상된 능력입니다. Anthropic은 이러한 자율성을 강조하는 초기 액세스 테스트의 몇 가지 예를 설명했습니다.
한 Frontier-Bench 작업에서 모델은 기계 부품의 도면을 받고 이를 3D FreeCAD 모델로 재구성하기 위한 코드를 작성하도록 요청받았지만 의도적으로 도면을 직접 볼 수 있는 방법은 제공되지 않았습니다. Opus 5는 자체 컴퓨터 비전 파이프라인을 작성하여 원시 픽셀에서 형상을 추출한 다음 전체 부품을 재구성하여 5번의 시도 후에 경쟁 모델이 작업을 해결할 수 없는 곳에서 반복적으로 성공했다고 합니다.
인기 있는 오픈 소스 패키지 관리자의 실제 버그가 있는 경우 Opus 5는 근본 원인을 찾아 커뮤니티 자체 패치에서 놓친 극단적인 경우를 수정한 반면, 경쟁 모델은 표면적인 증상만 수정하고 버그가 해결되었다고 선언했습니다. 한 무역 회사의 엔지니어는 Opus 5를 사용하여 단일 세션에서 새로운 거래소에 대한 시장 데이터 피드를 구축한 것으로 알려졌습니다. 이는 이전 모델에서는 전혀 완료할 수 없었던 작업이었습니다. 그리고 검증할 라이브 피드가 없음을 발견하고 모델은 자체 테스트 하네스를 구축했습니다.
고객접수
초기 액세스 파트너는 대체로 긍정적인 평가를 제공했습니다. Cognition(Devin 코딩 에이전트 제조업체)의 CEO인 Scott Wu는 Opus 5가 "절반의 비용으로 Fable 수준의 성능에 접근"하며 "어려운 디버깅 및 근본 원인 분석 작업에 특히 강점을 보인다"고 말했습니다. Cursor의 공동 창립자인 Sualeh Asif는 이 모델이 "Opus의 속도와 비용으로 Fable 5에 가까운 지능"을 제공한다고 말했습니다.
Zapier의 CEO인 Wade Foster는 Opus 5가 "이전 Claude 모델보다 더 많은 토큰을 지출하지 않고도 Zapier의 AutomationBench 리더보드에서 1위를 차지했으며" 전체 이탈 방지 워크플로를 엔드 투 엔드(위험 계정에 플래그 지정, 올바른 소유자에게 경고, 유지 팀에 요약) 완료했다고 보고했습니다. 이전 모델은 통과하지 못했습니다. Opus 5는 100%를 달성했습니다.
과학 연구의 이득
Anthropic은 또한 과학 작업에 대한 Opus 5의 개선 사항을 강조했습니다. 이 모델은 구조 생물학, 유기 화학, 생물정보학을 포함하는 Anthropic의 모든 생명과학 평가에서 Opus 4.8보다 성능이 뛰어납니다. 회사는 내부 유기화학 벤치마크(분광학 데이터에서 분자 구조 추론)가 10.2% 포인트 향상되었고, 단백질 기능 예측 작업이 7.7% 포인트 향상되었다고 지적했습니다. 한 유전체학 고객은 이 모델이 "신중한 과학자처럼 행동"하고 올바른 통계 테스트에 도달하고 자체 결과를 교차 확인한다고 설명했습니다.
가격 전략
Fable 5의 인텔리전스에 접근하면서 Opus 5의 가격을 Opus 4.8과 동일한 수준으로 책정함으로써 Anthropic은 미드티어 제품과 주력 제품 간의 격차를 효과적으로 좁히고 있습니다. VentureBeat는 이 릴리스를 "코딩, 에이전트 및 엔터프라이즈 워크플로를 위한 저렴한 AI 모델"로 구성했으며 Seeking Alpha는 Opus 5가 "프론티어 모델 Fable 5에 더 가깝고 저렴하다"고 관찰했습니다. 이 회사는 고객이 속도와 토큰 비용 절감을 위해 인텔리전스를 교환하고 작업당 비용 대비 성능 비율을 미세 조정할 수 있도록 조정 가능한 "노력" 설정을 제공합니다.
AI 경주에 미치는 영향
Opus 5는 근접한 AI의 비용이 얼마나 빠르게 하락하고 있는지 강조합니다. 토큰 가격의 절반으로 사용 가능한 가장 유능한 시스템과 가까운 거리에 있는 모델은 경쟁업체가 한계 이익을 위해 프리미엄 가격을 정당화하도록 압력을 가합니다. Anthropic, OpenAI, Google 등이 일상적인 대규모 배포에 충분히 저렴한 성능의 모델을 만들기 위해 경쟁하면서 기업의 질문은 "어떤 모델이 가장 똑똑한가?"에서 옮겨가고 있습니다. "어떤 모델이 달러당 가장 많은 지능을 제공합니까?"
Anthropic의 메시지는 분명합니다. 고급 추론은 더 이상 사치품이 아닙니다. Opus 5는 지속적이고 일상적인 배포를 현실적으로 만드는 가격대에 국경에 인접한 기능을 제공하며 이는 가장 중요한 세부 사항이 될 수 있습니다.
AI보다 앞서 나가세요
Claude Opus 5는 오늘부터 Claude Pro, Claude Max 및 Anthropic의 API를 통해 사용할 수 있습니다. 이 이야기와 더 넓은 인공 지능 환경에 대한 자세한 내용을 보려면 AI 속보에서 최신 소식을 확인하세요.
AI 뉴스 자세히 보기 →