Anthropic đã phát hành Claude Haiku 5.5 vào thứ Ba, mô tả nó là “mẫu máy nhỏ rẻ nhất, nhanh nhất và có khả năng hoạt động tốt nhất mà chúng tôi từng phát hành”. Việc ra mắt đi kèm với việc giảm giá mạnh hai cấp giúp giảm chi phí đầu vào xuống 0,10 USD trên một triệu mã thông báo cho hầu hết các yêu cầu, một động thái gây áp lực trực tiếp lên GPT-6 Luna của OpenAI trong phân khúc mô hình nhỏ và kéo dài cuộc chiến giá cả kéo dài hàng tháng trên toàn ngành AI.

Thông báo được công bố trên trang web của Anthropic vào ngày 7 tháng 10 năm 2026, xếp Haiku 5.5 là mô hình thứ ba trong gia đình Claude 5.5, cùng với Sonnet 5.5 và Opus 5.5. Reuters mô tả việc phát hành là khi Anthropic mở rộng dòng mô hình của mình khi chuẩn bị cho đợt IPO theo kế hoạch và mô hình này đã có sẵn trên GitHub Copilot, Amazon Web Services, Google Cloud và Microsoft Foundry. Sự ra mắt này là mục mới nhất trong một tháng của tin nóng về AI, trong đó gần như ngày nào cũng có các đợt phát hành mô hình, giảm giá và thay đổi chính sách.

Một mô hình nhỏ được xây dựng cho công việc khối lượng lớn

Theo Anthropic, Claude Haiku 5.5 được thiết kế cho các nhiệm vụ có khối lượng lớn, nhạy cảm với chi phí hơn là lý luận ở cấp độ biên giới. Công ty cho biết họ "xử lý đáng tin cậy các khối lượng công việc nhanh chóng và lặp đi lặp lại" như tóm tắt, nén, truy vấn cơ sở dữ liệu và yêu cầu phân loại.

Anthropic cũng định vị mô hình mới như một người bạn đồng hành với các hệ thống lớn hơn của nó: Haiku 5.5 "kết hợp tốt với Opus 5.5 và Sonnet 5.5 như một tác nhân phụ trong công việc mã hóa", cho phép các nhà phát triển định tuyến các nhiệm vụ phụ nhanh, rẻ tiền tới Haiku trong khi dành các mô hình lớn hơn cho lý luận phức tạp. Vì đây là mô hình nhanh nhất của Anthropic cho đến nay ở tốc độ tiêu chuẩn nên công ty khuyến nghị sử dụng mô hình này cho các ứng dụng nhạy cảm với độ trễ như hỗ trợ khách hàng trực tiếp và sử dụng trình duyệt. Một chú thích cuối trang bổ sung thêm một cảnh báo: Các mẫu Opus của Anthropic vẫn chạy nhanh hơn ở Chế độ nhanh.

Giá: Rẻ hơn tới 90% so với Haiku 4.5

Sự thay đổi tiêu đề là giá cả. Anthropic cho biết chi phí vận hành của Haiku 5.5 trung bình thấp hơn khoảng 75% so với Haiku 4.5, với cấu trúc phân tầng phụ thuộc vào kích thước lời nhắc.

Đối với các yêu cầu có lời nhắc lên tới 100.000 mã thông báo – mà Anthropic cho biết chiếm khoảng 90% yêu cầu đối với mô hình Haiku trước đó – giá thấp hơn 90% so với Haiku 4.5. Lời nhắc trên 100.000 mã thông báo có giá thấp hơn 50%.

Bảng giá mỗi triệu token từ thông báo của Anthropic cho thấy quy mô cắt giảm:

  • Mã thông báo đầu vào: 0,10 USD (nhắc lên tới 100K) hoặc 0,50 USD (trên 100K), giảm từ mức 1,00 USD cố định cho Haiku 4.5
  • Mã thông báo đầu ra: $0,50 hoặc $2,50, giảm từ $5,00
  • Bộ nhớ đệm ghi: 0,01 USD hoặc 0,05 USD, giảm từ 0,10 USD
  • Bộ nhớ đệm ghi: $0,125 hoặc $0,625, giảm từ $1,25

Ở cấp dưới 100K, điều đó khiến giá đầu ra của Haiku 5.5 bằng 1/5 so với 10,00 USD trên một triệu mã thông báo đầu ra của Sonnet 5.5.

Anthropic lưu ý một chi tiết kỹ thuật đằng sau các con số: Haiku 5.5 sử dụng mã thông báo được cập nhật, tương tự như Sonnet 5.5 và Opus 5.5, có nghĩa là nó sử dụng nhiều mã thông báo hơn cho mỗi nhiệm vụ so với Haiku 4.5. Công ty cho biết tính toán chi phí trung bình của họ đã giải thích được sự khác biệt đó.

Điểm chuẩn: Trước GPT-6 Luna ở hầu hết các hàng

Anthropic đã công bố bảng điểm chuẩn so sánh Haiku 5.5 với Haiku 4.5, GPT-6 Luna và Sonnet 5.5. Trong hầu hết các đánh giá được liệt kê, mẫu mới về đích trước Luna và dẫn trước đáng kể so với mẫu trước đó:

  • GDPval-AA v2.1 (công việc kiến thức): 1620 cho Haiku 5.5, so với 735 cho Haiku 4.5, 1437 cho GPT-6 Luna và 1840 cho Sonnet 5.5
  • AA-Briefcase v1.1: 1578, so với 614 của Haiku 4.5 và 1336 của Luna
  • OSWorld 2.1, tập hợp con ngoại tuyến (sử dụng máy tính): 72,4%, so với 15,7% của Haiku 4.5, 48,9% của Luna và 83,9% của Sonnet 5.5
  • Bài kiểm tra cuối cùng của nhân loại: 45,9% không có công cụ và 57,4% có công cụ, so với 10,2% và 18,7% của Haiku 4.5
  • Terminal-Bench 4.0 (mã hóa tác nhân): 39,2%, so với 16,4% của Luna và 70,6% của Sonnet 5.5
  • FrontierCode 1.1, Main: 46,4%, cao hơn 42,4% của Luna

Mô hình nhất quán: Haiku 5.5 thu hẹp phần lớn khoảng cách với GPT-6 Luna và khi sử dụng máy tính, đánh bại nó hoàn toàn, trong khi Sonnet 5.5 của Anthropic vẫn dẫn đầu mọi hạng mục. Hướng dẫn của Anthropic phản ánh hệ thống phân cấp đó - công ty cho biết Sonnet 5.5 và Opus 5.5 "vẫn là những lựa chọn tốt hơn cho các tác vụ mã hóa tác nhân phức tạp giống như các tác vụ được đo bằng Terminal-Bench 4.0", trong khi Haiku 5.5 nhắm mục tiêu vào công việc có phạm vi hẹp mà "có thể bị cấm về mặt chi phí với các phiên bản trước của Claude."

Haiku đầu tiên với sự nỗ lực quay số

Haiku 5.5 cũng là mẫu máy Haiku đầu tiên được xuất xưởng với cài đặt nỗ lực có thể điều chỉnh, hệ thống kiểm soát chi phí so với trí thông minh mà Anthropic trước đây đã cung cấp trên các mẫu lớn hơn. Người dùng có thể chọn mức tiêu thụ điện toán cho mỗi yêu cầu và biểu đồ của Anthropic hiển thị điểm chuẩn ở từng mức nỗ lực từ Thấp đến Tối đa.

Thế trận an toàn: Chặt hơn Haiku 4.5, Nới lỏng hơn Sonnet

Về an toàn, Anthropic cho biết Haiku 5.5 cho thấy "những cải tiến lớn trong hầu hết các đánh giá liên kết của chúng tôi so với Haiku 4.5", với ít trường hợp hành vi sai lệch hơn và mức độ sẵn sàng hợp tác với việc sử dụng sai mục đích thấp hơn nhiều.

Các biện pháp bảo vệ an ninh mạng của mô hình này hạn chế hơn so với Haiku 4.5, mặc dù ít hạn chế hơn so với các biện pháp bảo vệ trên các mô hình lớn hơn gần đây của Anthropic. Chúng cho phép thực hiện nhiều nhiệm vụ bảo mật phòng thủ hơn so với các biện pháp bảo vệ của Sonnet 5.5 nhưng vẫn chặn các thử nghiệm thâm nhập và các kỹ thuật có nhiều khả năng được kẻ tấn công sử dụng hơn. Các biện pháp bảo vệ sinh học phù hợp với các biện pháp bảo vệ của Sonnet 5, Sonnet 5.5 và Opus 5. Các tổ chức cần quyền truy cập rộng hơn có thể đăng ký các Chương trình Xác minh Mạng hoặc Khoa học Đời sống của Anthropic. Chi tiết đầy đủ có trong thẻ hệ thống Haiku 5.5.

Phần còn lại của thông báo: Sonnet rẻ hơn, Tín dụng API miễn phí

Buổi ra mắt đi kèm với một số thay đổi khác. Việc đọc bộ nhớ đệm trên Claude Sonnet 5.5 hiện có giá 0,10 USD trên một triệu mã thông báo thay vì 0,20 USD - mức giảm 50% mà Anthropic cho biết khiến Sonnet 5.5 rẻ hơn khoảng 20% ​​đối với hầu hết các công việc tác nhân, vì việc đọc bộ nhớ đệm chi phối mức tiêu thụ mã thông báo trong quy trình làm việc của tác nhân.

Anthropic cũng sẽ triển khai tín dụng API hàng tháng trong tuần này cho khách hàng đăng ký: 100 USD mỗi tháng cho người dùng Max 5x, 200 USD cho người dùng Max 20x và tối đa 500 USD gộp cho người dùng cho các gói Nhóm, có thể sử dụng trên mọi mô hình. Các khoản tín dụng nhằm mục đích giúp người đăng ký xây dựng các công cụ và đại lý trên Nền tảng Claude.

Các nhà phát triển cũng nhận được các bản cập nhật SDK: SDK Python và TypeScript của Anthropic hiện hỗ trợ việc sử dụng máy tính và trình duyệt trong phiên bản beta, các khả năng mà công ty cho biết phù hợp với hồ sơ giá-tốc độ của Haiku 5.5.

Cuộc chiến về giá chưa có hồi kết

Phạm vi đưa tin của Bộ giải mã đóng khung buổi ra mắt như một bằng chứng cho thấy "cuộc chạy đua vũ trang về định giá AI còn lâu mới kết thúc" và những con số hỗ trợ cho nhận định đó. Vào tháng 9, Anthropic và OpenAI đã tung ra các mẫu máy hàng đầu đối thủ cách nhau vài giờ, hoàn thành với việc giảm giá cạnh tranh. Haiku 5.5 mở rộng cuộc chiến đó đến phân khúc thấp của thị trường, nơi các mô hình nhỏ cung cấp khối lượng công việc có khối lượng cao nhất, nhạy cảm về giá nhất.

Đối với các nhà phát triển, hiệu quả trước mắt rất đơn giản: suy luận mô hình nhỏ trên nền tảng Claude hiện bắt đầu ở mức 0,10 USD trên một triệu mã thông báo đầu vào và 0,50 USD trên một triệu mã thông báo đầu ra, trong đó GPT-6 Luna đã vượt qua hầu hết các điểm chuẩn được công bố của Anthropic ở mức giá đó. Việc OpenAI phản ứng bằng việc giảm giá Luna - hay chờ bản phát hành mẫu nhỏ tiếp theo - sẽ báo hiệu mức giá sàn này thực sự bền đến mức nào.

Haiku 5.5 hiện có sẵn trên các ứng dụng và API bên thứ nhất của Anthropic, Amazon Web Services, Google Cloud và Microsoft Foundry, đồng thời đã được tích hợp vào GitHub Copilot.

Đi trước AI Đọc thêm tin tức về AI trên AI Buzz Wire