Anthropic은 화요일에 Claude Haiku 5.5를 출시하면서 "지금까지 출시한 소형 모델 중 가장 저렴하고 빠르며 성능이 뛰어난 소형 모델"이라고 설명했습니다. 이번 출시에는 대부분의 요청에 대해 입력 비용을 백만 토큰당 0.10달러로 낮추는 가파른 2단계 가격 인하가 포함됩니다. 이는 소형 모델 부문에서 OpenAI의 GPT-6 Luna에 직접적인 압력을 가하고 AI 업계 전반에 걸쳐 몇 달 동안 가격 전쟁을 연장하는 움직임입니다.
2026년 10월 7일 Anthropic 웹사이트에 발표된 이 발표는 Haiku 5.5를 Sonnet 5.5 및 Opus 5.5와 함께 Claude 5.5 제품군의 세 번째 모델로 지정했습니다. Reuters는 이번 출시를 Anthropic이 계획된 IPO를 준비하면서 모델 라인업을 확장하는 것으로 특징지었고 해당 모델은 이미 GitHub Copilot, Amazon Web Services, Google Cloud 및 Microsoft Foundry에서 사용할 수 있습니다. 이번 출시는 거의 매일 모델 출시, 가격 인하, 정책 움직임이 나타난 AI 속보 한 달 만에 나온 최신 기사입니다.
대용량 작업을 위해 제작된 소형 모델
Anthropic에 따르면 Claude Haiku 5.5는 최전선 수준의 추론보다는 비용에 민감한 대용량 작업을 위해 설계되었습니다. 회사는 요약, 압축, 데이터베이스 쿼리 및 분류 요청과 같은 "빠르고 반복적인 작업 부하를 안정적으로 처리"한다고 말합니다.
Anthropic은 또한 새로운 모델을 더 큰 시스템의 동반자로 자리매김했습니다. Haiku 5.5는 "코딩 작업의 하위 에이전트로서 Opus 5.5 및 Sonnet 5.5와 잘 어울립니다." 개발자는 복잡한 추론을 위해 더 큰 모델을 예약하면서 저렴하고 빠른 하위 작업을 Haiku로 라우팅할 수 있습니다. 표준 속도에서 현재까지 Anthropic의 가장 빠른 모델이기 때문에 회사는 실시간 고객 지원 및 브라우저 사용과 같이 대기 시간에 민감한 애플리케이션에 권장합니다. 한 각주는 경고를 추가합니다. Anthropic의 Opus 모델은 여전히 빠른 모드에서 더 빠르게 실행됩니다.
가격: Haiku 4.5보다 최대 90% 저렴
헤드라인 변경은 가격입니다. Anthropic은 Haiku 5.5가 평균적으로 Haiku 4.5보다 실행 비용이 약 75% 저렴하며 프롬프트 크기에 따라 달라지는 계층 구조를 가지고 있다고 말합니다.
이전 Haiku 모델에 대한 요청의 약 90%를 차지한다고 Anthropic이 밝힌 최대 100,000개의 토큰에 대한 프롬프트 요청의 경우 가격은 Haiku 4.5보다 90% 저렴합니다. 100,000개 이상의 토큰을 묻는 메시지는 비용이 50% 저렴합니다.
Anthropic의 발표에 나온 백만 개당 토큰 가격표는 인하 규모를 보여줍니다.
- 입력 토큰: $0.10(최대 100K까지 프롬프트) 또는 $0.50(100K 이상), Haiku 4.5의 경우 $1.00 고정에서 인하되었습니다.
- 출력 토큰: $5.00에서 $0.50 또는 $2.50로 인하되었습니다.
- 캐시 읽기: $0.10에서 $0.01 또는 $0.05로 인하되었습니다.
- 캐시 쓰기: $1.25에서 $0.125 또는 $0.625로 인하되었습니다.
100K 미만 계층에서는 Haiku 5.5의 출력 가격이 Sonnet 5.5의 백만 출력 토큰당 $10.00의 1/5이 됩니다.
Anthropic은 숫자 뒤에 숨겨진 한 가지 기술적 세부 사항을 언급합니다. Haiku 5.5는 Sonnet 5.5 및 Opus 5.5와 유사하게 업데이트된 토크나이저를 사용합니다. 이는 Haiku 4.5보다 작업당 약간 더 많은 토큰을 사용한다는 것을 의미합니다. 회사는 평균 비용 계산이 이러한 차이를 설명한다고 말합니다.
벤치마크: 대부분의 행에서 GPT-6 Luna를 앞지름
Anthropic은 Haiku 5.5를 Haiku 4.5, GPT-6 Luna 및 Sonnet 5.5와 비교하는 벤치마크 테이블을 게시했습니다. 나열된 대부분의 평가에서 새 모델은 Luna보다 앞서 완료되었으며 이전 모델보다 극적으로 앞서 있습니다.
- GDPval-AA v2.1(지식 작업): Haiku 5.5의 경우 1620, Haiku 4.5의 경우 735, GPT-6 Luna의 경우 1437, Sonnet 5.5의 경우 1840
- AA-Briefcase v1.1: 1578(Haiku 4.5의 경우 614, Luna의 경우 1336)
- OSWorld 2.1, 오프라인 하위 집합(컴퓨터 사용): 72.4%, Haiku 4.5의 경우 15.7%, Luna의 경우 48.9%, Sonnet 5.5의 경우 83.9%
- 인류의 마지막 시험: 도구가 없는 경우 45.9%, 도구가 있는 경우 57.4%, Haiku 4.5의 경우 10.2% 및 18.7%
- 터미널-벤치 4.0(에이전트 코딩): 39.2%, Luna의 경우 16.4%, Sonnet 5.5의 경우 70.6%
- FrontierCode 1.1, Main: 46.4%로 Luna의 42.4%를 앞지릅니다.
패턴은 일관됩니다. Haiku 5.5는 GPT-6 Luna와의 격차를 상당 부분 줄이고 컴퓨터 사용에서는 이를 완전히 능가하는 반면 Anthropic의 Sonnet 5.5는 여전히 모든 범주에서 선두를 달리고 있습니다. Anthropic의 지침은 이러한 계층 구조를 반영합니다. 회사에서는 Sonnet 5.5와 Opus 5.5가 "Terminal-Bench 4.0에서 측정된 것과 같은 복잡한 에이전트 코딩 작업에 더 나은 선택으로 남아 있는 반면" Haiku 5.5는 "이전 버전의 Claude에서는 비용이 많이 들었을 수 있는" 좁은 범위의 작업을 대상으로 한다고 말합니다.
노력 다이얼로 첫 하이쿠
Haiku 5.5는 이전에 대형 모델에서 제공되었던 Anthropic의 비용 대비 지능 제어인 조정 가능한 노력 설정을 갖춘 최초의 Haiku급 모델이기도 합니다. 사용자는 각 요청이 소비하는 컴퓨팅 양을 선택할 수 있으며 Anthropic의 차트에는 낮음에서 최대까지 각 노력 수준의 벤치마크 점수가 표시됩니다.
안전 자세: 하이쿠 4.5보다 단단하고 소네트보다 느슨함
안전에 관해 Anthropic은 Haiku 5.5가 "Haiku 4.5에 비해 거의 모든 정렬 평가에서 주요 개선 사항"을 보여주며 잘못된 동작 사례가 훨씬 적고 오용에 협조하려는 의지가 낮다고 말합니다.
이 모델의 사이버 보안 보호 장치는 Haiku 4.5보다 더 제한적이지만 Anthropic의 최근 대형 모델보다 다소 덜 제한적입니다. Sonnet 5.5의 보호 기능보다 더 넓은 범위의 방어 보안 작업을 허용하지만 여전히 공격자가 사용할 가능성이 더 높은 침투 테스트 및 기술을 차단합니다. 생물학 보호 조치는 Sonnet 5, Sonnet 5.5 및 Opus 5와 일치합니다. 더 광범위한 접근이 필요한 조직은 Anthropic의 생명 과학 또는 사이버 검증 프로그램에 신청할 수 있습니다. 자세한 내용은 Haiku 5.5 시스템 카드에 있습니다.
나머지 공지: 더 저렴한 Sonnet, 무료 API 크레딧
출시는 몇 가지 다른 변경 사항과 함께 패키지되었습니다. Claude Sonnet 5.5의 캐시 읽기 비용은 이제 0.20달러가 아닌 백만 토큰당 0.10달러입니다. Anthropic에 따르면 이 50% 절감으로 대부분의 에이전트 작업에서 Sonnet 5.5가 약 20% 더 저렴해집니다. 캐시 읽기가 에이전트 워크플로에서 토큰 소비를 지배하기 때문입니다.
Anthropic은 또한 이번 주에 구독 고객을 위해 월간 API 크레딧을 출시합니다. 최대 5x 사용자의 경우 월 $100, 최대 20x 사용자의 경우 $200, 모든 모델에서 사용할 수 있는 Team 플랜의 경우 사용자 간에 최대 $500까지 풀링됩니다. 크레딧은 Claude 플랫폼에서 도구와 에이전트를 구축하는 가입자를 대상으로 합니다.
개발자는 SDK 업데이트도 받습니다. Anthropic의 Python 및 TypeScript SDK는 이제 베타 버전에서 컴퓨터 사용과 브라우저 사용을 지원합니다. 이 기능은 회사에서 Haiku 5.5의 속도 가격 프로필에 적합하다고 말합니다.
끝이 보이지 않는 가격 전쟁
Decoder의 보도는 출시를 "AI 가격 군비 경쟁이 끝나지 않았다"는 증거로 구성했으며, 숫자는 이러한 판독을 뒷받침합니다. 지난 9월, Anthropic과 OpenAI는 경쟁적인 가격 인하를 통해 서로 몇 시간 만에 경쟁 플래그십 모델을 출시했습니다. Haiku 5.5는 소규모 모델이 가장 큰 볼륨과 가장 가격에 민감한 워크로드를 지원하는 저가형 시장으로 이러한 경쟁을 확장합니다.
개발자의 경우 즉각적인 효과는 간단합니다. Claude 플랫폼의 소규모 모델 추론은 이제 백만 입력 토큰당 0.10달러, 출력 토큰 백만 달러당 0.50달러에서 시작하며, GPT-6 Luna는 해당 가격대에서 Anthropic이 게시한 대부분의 벤치마크에서 승리했습니다. OpenAI가 Luna 가격 인하로 대응할지, 아니면 다음 소형 모델 출시를 기다릴지 여부는 이 가격 하한선이 실제로 얼마나 내구성이 있는지를 알려줄 것입니다.
Haiku 5.5는 이제 Anthropic의 자사 앱과 API, Amazon Web Services, Google Cloud 및 Microsoft Foundry에서 사용할 수 있으며 이미 GitHub Copilot에 통합되어 있습니다.
AI보다 앞서 나가세요 AI 버즈와이어에서 AI 소식 더 보기