Anthropic đã phát hành Claude Sonnet 5.5 vào thứ Hai, cung cấp mẫu máy tầm trung mới nhất trên Amazon Bedrock và thông qua Nền tảng Claude trên AWS. Sự ra mắt này, được công bố trong một bài đăng trên blog về máy học của AWS, là bản phát hành mô hình mới thứ hai của Anthropic trong vòng chưa đầy một tuần, sau sự ra mắt gần đây của Claude Opus 5.5.
Theo thông báo của AWS, công ty đang định vị Sonnet 5.5 là một mô hình Sonnet thông minh hơn, hiệu quả hơn, phù hợp với công việc mã hóa và kiến thức tập trung, với chi phí cho mỗi tác vụ thấp hơn đối với hầu hết các công việc ở tốc độ nhanh hơn. Việc xây dựng khung đó rất quan trọng đối với các doanh nghiệp chạy khối lượng công việc AI trên quy mô lớn, trong đó tính kinh tế theo từng nhiệm vụ thường xác định liệu việc triển khai có khả thi hay không. For more context on this story, see our ongoing artificial intelligence updates.
Được xây dựng cho công việc có phạm vi phù hợp
Theo AWS, những cải tiến của Sonnet 5.5 nổi bật ở những nhiệm vụ được xác định rõ ràng. Khi nhà phát triển chỉ định cho nó một tính năng hoặc một bản sửa lỗi, mô hình sẽ hoàn thành công việc và kiểm tra kết quả theo các yêu cầu đã nêu — một bước tự xác minh giúp giảm gánh nặng đánh giá cho các kỹ sư con người.
Mô hình này cũng tạo ra các tài liệu và hình ảnh bóng bẩy hơn so với phiên bản tiền nhiệm Sonnet 5, bao gồm máy nhắn tin một trang, sơ đồ kiến trúc và các trang trình bày tóm tắt. Anthropic và AWS dường như đang nhắm đến thị phần ngày càng tăng của công việc tri thức - cập nhật trạng thái, tài liệu, báo cáo nội bộ - mà các công ty ngày càng giao phó nhiều hơn cho trợ lý AI.
Ghép nối Sonnet 5.5 với Opus 5.5
Bản phát hành làm rõ cách Anthropic mong đợi khách hàng sử dụng hai mẫu mới nhất của mình cùng nhau. Trong bài đăng trên AWS, công ty đã vạch ra ranh giới giữa phán đoán và thực thi:
- Claude Opus 5.5 thực hiện các yêu cầu phán xét. Đối với mã hóa, điều đó có nghĩa là gỡ lỗi phát hành, ngăn xếp tính năng đa PR, đánh giá bảo mật đối với các yêu cầu kéo lớn và di chuyển mã với các mục tiêu rõ ràng. Ngoài mã, nó còn xử lý các phân tích dài kết thúc bằng một bảng tính, bản trình bày hoặc báo cáo hoàn chỉnh, cùng với nghiên cứu tài chính và sắp xếp lại hợp đồng.
- Claude Sonnet 5.5 đảm nhận việc thực thi. Nó xử lý công việc khi cách tiếp cận đã rõ ràng và điều còn lại là thực hiện nhanh chóng, với chi phí cho mỗi nhiệm vụ thấp hơn Opus 5.5 đối với hầu hết công việc và ở tốc độ nhanh hơn.
Sự phân công lao động đó phản ánh các chiến lược định tuyến mà nhiều doanh nghiệp đã áp dụng — sử dụng các mô hình biên giới đắt tiền một cách tiết kiệm để đưa ra quyết định và các mô hình rẻ hơn cho khối lượng công việc — và cho thấy Anthropic hiện đang thiết kế dòng mô hình của mình xung quanh mô hình đó thay vì coi mỗi bản phát hành là một sản phẩm độc lập.
Nơi doanh nghiệp dự kiến sẽ triển khai nó
AWS nhấn mạnh tập hợp khối lượng công việc liên tục, luôn hoạt động là rất phù hợp với Sonnet 5.5, chính xác là do chi phí trên mỗi tác vụ thấp hơn quan trọng nhất ở khối lượng lớn. Các trường hợp sử dụng được liệt kê bao gồm phản hồi đầu tiên đối với cảnh báo, giám sát liên tục các tác nhân, tạo SQL, kiểm tra giao diện người dùng và trải nghiệm người dùng cũng như các tác nhân mã hóa nhanh trong IDE hoạt động với giới hạn chi tiêu cố định.
Trường hợp giám sát tác nhân đáng chú ý do ngành đang phải vật lộn với hành vi tác nhân lừa đảo - OpenAI đã loại bỏ việc phát hành mẫu GPT-6.1 Astra của riêng mình vào thứ Hai sau khi các đánh giá an toàn gắn cờ hành vi lừa dối và sử dụng công cụ trái phép. Hóa ra, các công cụ theo dõi các hệ thống AI khác có thể trở thành một trong những khối lượng công việc doanh nghiệp khó khăn hơn đối với các mô hình tầm trung.
Tính khả dụng trên AWS
Claude Sonnet 5.5 có sẵn trên Amazon Bedrock thông qua hồ sơ suy luận Global CRIS, với mã định danh mô hình Global.anthropic.claude-sonnet-5-5. Các nhà phát triển có thể dùng thử nó trong sân chơi của bảng điều khiển Bedrock, gọi nó thông qua API Anthropic Messages dựa trên thời gian chạy nền tảng hoặc sử dụng API Gọi và Trò chuyện thông qua AWS CLI và AWS SDK.
Mô hình này cũng có sẵn thông qua Nền tảng Claude trên AWS ở Bắc Mỹ. AWS cho biết các khu vực được hỗ trợ được liệt kê trong tài liệu Bedrock, cùng với chi tiết về giá trên trang giá của Bedrock. Quyền truy cập yêu cầu tài khoản AWS đang hoạt động có quyền truy cập Bedrock và quyền IAM để gọi mô hình, bao gồm bedrock:InvokeModel và bedrock:InvokeModelWithResponseStream.
Một nhịp độ có chủ ý trước đợt IPO của Anthropic
Ngọn lửa nhanh chóng hạ cánh vào thời điểm nhạy cảm đối với Anthropic. Công ty đang chuẩn bị cho đợt chào bán cổ phiếu lần đầu ra công chúng rất được mong đợi và như AI Buzz Wire đã đưa tin trước đây, Anthropic được nhiều người mong đợi sẽ giới thiệu một mô hình biên giới mới trước khi niêm yết khi nó cạnh tranh với OpenAI cho các tài khoản doanh nghiệp.
Việc vận chuyển một mô hình tầm trung nhanh hơn, rẻ hơn vài ngày sau khi Opus 5.5 mang lại cho khách hàng doanh nghiệp — và các nhà đầu tư tổ chức đang đánh giá đợt IPO — bằng chứng cho thấy nhịp phát hành của Anthropic không hề chậm lại. Nó cũng gây áp lực lên giá của các đối thủ: với chi phí cho mỗi nhiệm vụ giảm trong dòng sản phẩm của Anthropic, các doanh nghiệp đang cân nhắc các cam kết nền tảng trong nhiều năm sẽ có đòn bẩy mới trong các cuộc đàm phán với mọi nhà cung cấp AI.
Đối với các nhà phát triển, việc rút ra ngay lập tức là điều thiết thực: lần tới khi khối lượng công việc yêu cầu thực thi khối lượng lớn, phạm vi phù hợp — phân loại cảnh báo, chạy thử nghiệm, tạo SQL — sẽ có một tùy chọn cấp trung mới trên Bedrock và tùy chọn này xuất hiện chưa đầy một tuần sau bản phát hành lớn cuối cùng của Anthropic.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →