Anthropic은 2026년 9월 1일 Claude Fable 5.1 및 Claude Mythos 5.1을 출시하여 회사가 코딩 및 지식 작업을 위한 세계에서 가장 진보된 모델이라고 부르는 것을 소개하고 AI 시스템이 과학 연구에 어떻게 기여할 것인지를 미리 엿볼 수 있습니다. Anthropic의 웹사이트에 게시된 이번 발표는 비용, 개인 정보 보호 및 보호 조치에 대한 고객 피드백에 직접적으로 대응하는 일련의 가격 책정 및 데이터 처리 변경 사항과 함께 도착했습니다.

특이한 두 이름의 출시는 두 가지 보호 구성을 갖춘 단일 기본 모델을 반영합니다. Fable 5.1은 일반적으로 모든 사용자가 사용할 수 있는 반면, Mythos 5.1은 Anthropic의 신뢰할 수 있는 액세스 프로그램용으로 예약되어 있으며, 보안 장치는 사이버 보안 및 생명 과학 분야의 작업을 지원하도록 특별히 설계되었습니다. AWS는 같은 날 "Introducing Claude Fable 5.1 on AWS"라는 제목의 출시 게시물을 통해 자사 플랫폼에서 Fable 5.1을 사용할 수 있음을 확인했으며 해당 뉴스는 게시 후 몇 시간 만에 600포인트 이상을 기록하며 Hacker News 상위권에 올랐습니다. 이 이야기에 대한 자세한 내용은 진행 중인 AI 속보 보도를 참조하세요.

가격 인하 및 데이터 보존 양보

대부분의 고객에게 헤드라인 변경은 비용입니다. Anthropic에 따르면 Fable 5.1은 사용량이 토큰으로 청구되는 일반적인 워크로드에 대해 Fable 5보다 비용이 약 25% 저렴할 것으로 예상됩니다. 이러한 감소는 모델이 이미 처리되고 저장된 입력을 읽을 때 캐시 읽기에 대한 가격이 낮아지기 때문에 발생합니다. 고도로 에이전트가 필요한 작업의 경우 절감액은 최대 약 45%에 달해 훨씬 더 큰 경우가 많다고 회사는 말했습니다.

더 큰 구조적 변화는 회사가 EFS(Enterprise Frontier Safeguards)라고 부르는 새로운 시스템입니다. Anthropic은 EFS가 기업 고객에게 완전한 개인 정보 보호(데이터 보존 정책 없음)를 제공하는 동시에 적대적인 사용에 대한 최첨단 보호를 유지한다고 말합니다. 메커니즘은 Anthropic이 아닌 고객이 전적으로 제어하는 ​​클라우드 인프라에 고객 데이터를 저장함으로써 작동합니다. EFS는 올 가을 말부터 단계적으로 기업 고객에게 출시될 예정이며, 정식 출시될 때까지 적격 고객은 데이터 보존 없이 Fable 5.1을 실행할 수 있습니다.

개인 정보 보호 양보는 눈에 띄는 고객 푸시백을 따릅니다. CNBC는 9월 1일에 Anthropic이 고객의 반대 이후 데이터 보존 정책을 변경했다고 보도했으며, EFS 발표는 Anthropic의 인프라에 데이터를 두지 않고 프론티어 모델 기능을 원하는 기업에 대한 회사의 가장 구체적인 대응입니다.

코딩 및 과학 전반에 걸친 벤치마크 향상

Anthropic이 발표한 평가는 이전 세대에 비해 상당한 향상을 보여주지만, 이 수치는 회사 자체 테스트에서 나온 것이므로 이에 따라 읽어야 합니다.

행위적 과학 연구 벤치마크인 Terminal-Bench-Science 0.1에서 Fable 5.1은 52.6%를 기록했으며, 동일한 설정에서 Fable 5는 24.7%를 기록했습니다. 동일한 벤치마크에서 Claude Opus 5는 29.0%를 기록했고 OpenAI의 GPT-5.6 Sol은 22.4%를 기록했습니다. 터미널 기반 에이전트 코딩 테스트인 Terminal-Bench 4.0에서 Fable 5.1은 55.8%를 기록했고, 더 가벼운 터치 보호 기능을 갖춘 Mythos 5.1은 Fable 5의 42.0%보다 높은 60.9%를 기록했습니다.

지식 작업 및 컴퓨터 사용 지표도 개선되었습니다. Fable 5.1은 GDPval-AA v2 평가에서 1853점을 얻었고 Fable 5는 1723점을 얻었으며 도구 없이 인류의 마지막 시험에서 60.9%, 도구를 사용하여 65.0%를 기록했습니다. 코딩 벤치마크인 CursorBench 3.2.0에서는 Fable 5의 70.5%에 비해 73.4%를 기록했습니다. 컴퓨터 사용에서는 OSWorld 2.0에서 부분적 77.9%, 엄격함 41.7%를 기록했고, AutomationBench에서는 이전 버전의 17.1%에서 31.4% 증가했습니다.

Anthropic은 또한 중요한 경고 사항을 공개했습니다. Fable 5.1은 생산 보호 장치가 활성화된 상태로 평가되었으며 이러한 보호 장치가 개입된 작업에서 모델의 점수는 0점이었습니다. 회사는 이 요소가 일부 벤치마크에서 결과를 저하시킬 가능성이 있다고 밝혔습니다.

회사는 노력 설정이 비용에 중요하다고 지적했습니다. Fable 5.1은 Claude Code에서는 높은 노력으로, Claude Cowork와 Claude.ai에서는 중간 노력으로 기본 설정되어 있으며, 낮은 노력 수준에서는 훨씬 저렴한 비용으로 Fable 5와 유사하거나 더 나은 결과를 얻습니다.

초기 고객은 생산성 향상을 보고합니다.

Anthropic은 역량과 경제성을 모두 강조하는 초기 액세스 파트너의 평가를 게시했습니다. Cognition은 출시일에 Devin의 Opus 5 트래픽을 Fable 5.1로 이전할 것이라고 밝혔습니다. Cognition의 공동 창립자이자 최고 제품 책임자인 Walden Yan은 "테스트에서 더 낮은 작업당 비용으로 Fable 5와 같거나 앞섰으며, 새로운 캐시 읽기 가격으로 Fable급 모델은 마침내 코드 검토를 시작으로 Opus에서 유지했던 워크로드에 대해 경제적입니다."라고 말했습니다.

양적 거래 회사인 Millennium은 놀라운 디버깅 일화를 제시했습니다. 한 고위 포트폴리오 관리자는 보기 드문 충돌(약 백만 번에 한 번꼴)이 회사 엔지니어들에 의해 4~5년 동안 설명되지 않았으며 그가 시도한 모든 모델에서 이를 놓쳤다고 말했습니다. Fable 5.1은 외부 공급업체 라이브러리를 분해하고 이를 코어 덤프와 비교한 다음 해당 라이브러리의 버그에 대한 충돌을 추적했습니다.

미디어 회사 Every의 CEO인 Dan Shipper는 테스트에서 이 모델이 Opus 5보다 약 2배 빠르면서도 절반의 토큰을 사용했다고 말했습니다. 그리고 법인 카드 스타트업인 Ramp는 모델이 이전 머신 러닝 결과를 라벨 아티팩트로 진단하고 이를 수정한 후 하룻밤 사이에 6개의 병렬 실험을 시작하고 결과와 다음 단계를 반환하는 38시간 무인 실행을 설명했습니다.

문자열이 연결된 더 부드러운 보호 장치

안전 측면에서 Anthropic은 자사의 최신 보호 장치가 사이버 보안에서 이전보다 60% 적은 오탐지를 발생시킨다고 밝혔습니다. 회사는 또한 기능 전환을 시작했습니다. 이제 Fable 5.1을 사용하여 소프트웨어 취약점을 발견할 수 있지만 이를 위한 익스플로잇을 개발하는 데는 사용할 수 없습니다.

생물학 분야에서는 미국 정부와 협력하여 개발된 프로그램을 통해 Mythos 5.1의 고급 기능에 접근할 수 있으며, 과학자 등록이 곧 시작될 것으로 예상됩니다. 회사는 이미 올해 초 Fable 5에 대한 생물학 관련 보호를 강화하여 쌍을 이루는 출시를 반전이 아닌 해당 정책의 연속으로 만들었습니다.

중요한 이유

이번 출시는 추론 가격이 빠르게 하락하고 있는 시장(AI Buzz Wire 분석에 따르면 최근 토큰 가격이 사상 최저치를 기록한 것으로 나타났습니다)에 출시되었으며 Anthropic은 분명히 프리미엄 요율을 방어하기보다는 에이전트 워크로드에 대한 가격 대비 성능으로 경쟁하기로 선택했습니다. OpenAI의 GPT-5.6 Sol 및 자체 Opus 5 라인과의 비교를 통해 회사는 Fable 5.1을 장기 실행 코딩 및 연구 작업을 위한 기본 선택으로 포지셔닝하고 있습니다. 독립적인 평가와 기업 채택을 통해 피치가 확인되는지 여부는 앞으로 몇 주에 걸쳐 명확해질 것입니다.

---

AI보다 앞서 나가세요

최신 AI 뉴스, 분석, 획기적인 소식을 모두 한 곳에서 받아보세요.

AI 뉴스 자세히 보기 →