Meta đã phát hành Muse Spark 1.3 vào thứ Ba, phiên bản mới nhất của mô hình hỗ trợ tác nhân mã hóa Muse Code và API Meta Model, cho biết bản cập nhật mang lại hiệu suất được cải thiện trên các tác vụ mã hóa và tác nhân. Thông báo được công bố trên blog nghiên cứu AI của Meta, được đưa ra khi công ty đang nỗ lực duy trì tính cạnh tranh của dòng sản phẩm mô hình của mình sau một năm mà các đối thủ đã xuất xưởng các hệ thống nhanh hơn, rẻ hơn và có khả năng cao hơn với tốc độ không ngừng. Để đưa tin nhiều hơn về hoạt động thúc đẩy AI của Meta và chu kỳ tin tức AI mới nhất rộng hơn, ấn phẩm này sẽ theo dõi mọi bản phát hành mô hình chính khi nó hạ cánh.

Những gì Meta nói là mới

Theo bài đăng trên blog của Meta, Muse Spark 1.3 được thiết kế để "duy trì tốt hơn công việc trong thời gian dài" bằng cách cộng tác với người dùng và xử lý nhiều quy trình công việc bên trong một chuỗi dài, duy nhất. Khi được đưa ra một mục tiêu mở, công ty cho biết mô hình này sử dụng các công cụ để tạo ra bối cảnh riêng của mình trên các nguồn lộn xộn và xung đột, chủ động sửa chữa các lỗ hổng trong kế hoạch của mình và theo dõi những gì họ đã học được trên đường đi đến sản phẩm cuối cùng.

Meta cũng nhấn mạnh rằng mô hình này đã được đào tạo trên nhiều bộ khai thác khác nhau để có thể khái quát hóa cho nhiều môi trường tác nhân khác nhau — giàn giáo của các công cụ, bộ nhớ và vòng phản hồi bao quanh một mô hình khi nó hoạt động như một tác nhân thay vì một chatbot.

Được xây dựng để cộng tác, không chỉ phản hồi

Chủ đề định kỳ trong thông báo là sự hợp tác. Meta cho biết Muse Spark 1.3 đặt ra các câu hỏi làm rõ khi lời nhắc không rõ ràng, gọi cho người dùng khi gặp khó khăn và xác nhận trước khi thực hiện các hành động tiếp theo. Đối với các tác vụ dài, mô hình này sẽ điều chỉnh theo sở thích của người dùng, cung cấp cập nhật tiến độ thường xuyên hoặc hoạt động lặng lẽ ở chế độ nền.

Công ty cũng cho biết mô hình này tuân theo các hướng dẫn dạng dài, phức tạp đáng tin cậy hơn so với các mẫu Muse Spark trước đó, duy trì các yêu cầu chi tiết trong các tác vụ nhiều bước mà không loại bỏ các ràng buộc hoặc đi chệch khỏi quy trình làm việc được yêu cầu.

Nhận thức tốt hơn về giới hạn của chính mình

Meta nhấn mạnh những cải tiến đối với cái có thể được gọi là sự hiểu biết về bản thân đã được hiệu chỉnh. Công ty viết rằng mô hình này đã được đào tạo để "có ý thức tốt hơn về những gì nó có thể và không thể làm, những gì nó biết và không biết, cũng như khi nó gặp trở ngại thay vì ảo giác về kết quả." Tính năng đa nhiệm cũng được chú ý cụ thể: mô hình giờ đây ánh xạ chính xác hơn các lời nhắc đến đúng tác vụ trong bối cảnh lộn xộn, đơn luồng, ngay cả khi người dùng ngắt quãng hoặc bỏ qua các yêu cầu trước đó.

Triển khai thông qua Muse Code và API Meta Model

Muse Spark 1.3 sẽ được triển khai ngay lập tức trong Muse Code, tác nhân mã hóa dựa trên thiết bị đầu cuối của Meta và thông qua API Meta Model. Một cảnh báo đáng chú ý: các chế độ lý luận có sẵn trước đây hiện đã có sẵn, nhưng Meta cho biết "lý luận tối đa" sẽ chỉ đến "ngay sau khi chúng tôi hoàn thành thử nghiệm an toàn bổ sung."

Quyết định đưa một chế độ vào sau đánh giá an toàn phản ánh một mô hình có thể thấy được trong toàn ngành trong những tháng gần đây, khi các phòng thí nghiệm ngày càng giữ lại những cấu hình có khả năng nhất của họ trong khi các cuộc đánh giá bắt kịp. Meta đóng khung toàn bộ bản phát hành như một bước tiến tới "siêu trí tuệ cá nhân", tham vọng mà Mark Zuckerberg đã đặt ở trung tâm chiến lược AI của công ty kể từ khi tổ chức lại các nỗ lực nghiên cứu vào năm ngoái.

Sự quan tâm sớm từ nhà phát triển

Bản phát hành đã thu hút sự chú ý ngay lập tức trên Hacker News, nơi câu chuyện đã thu thập được hàng trăm lượt tán thành trong vòng vài giờ. Nhà phát triển Simon Willison đã chạy tiêu chuẩn SVG dành cho xe đạp bồ nông trên xe đạp thông thường của mình so với mẫu mới và báo cáo rằng Muse Spark 1.3 tạo ra kết quả tốt hơn đáng kể so với 1,2, với chi phí khoảng 4 xu mỗi lần chạy.

Việc kiểm tra cộng đồng nhanh chóng phản ánh mức độ trưởng thành của khán giả đối với các bản phát hành này. Bản thân Muse Code chỉ mới ra mắt vào đầu tháng 8, được cung cấp bởi Muse Spark 1.2 và kể từ đó, các nhà phát triển đã đưa hệ thống này hoạt động trên mọi thứ, từ kỹ thuật đảo ngược các tệp nhị phân của trò chơi cũ cho đến sửa lỗi hàng ngày. Những người bình luận trên Hacker News so sánh 1.3 một cách thuận lợi với người tiền nhiệm của nó, trong khi những người khác lưu ý rằng họ đã chuyển đổi giữa các mô hình của Meta và các đối thủ như GLM-5.3-Flash tùy theo nhiệm vụ.

Bức tranh cạnh tranh

Bối cảnh xung quanh việc phát hành cũng quan trọng như nhật ký thay đổi. Google đã xuất xưởng Gemini 3.8 Flash và một biến thể đồng hành tập trung vào mạng trong tuần này - mô hình lớp Flash thứ ba trong khoảng sáu tuần, như Ars Technica đã lưu ý - trong khi OpenAI tiếp tục vật lộn với câu chuyện công khai xung quanh mô hình Astra của mình. Trong bối cảnh đó, Meta đang định vị Muse Spark 1.3 như một công cụ thực tế, hữu ích hơn là một công cụ dẫn đầu về tiêu chuẩn theo đuổi tiêu đề.

Liệu những cải tiến có đủ hay không sẽ được quyết định trong các đánh giá mà Meta công bố cùng với mô hình và cuối cùng là trong tay của các nhà phát triển, những người đã dành cả tháng qua để thử nghiệm Muse Code một cách căng thẳng. Công ty hứa sẽ cung cấp một báo cáo kèm theo chi tiết về các đánh giá của mình và cho biết các chế độ suy luận có khả năng hơn sẽ sắp ra mắt.

Hiện tại, thông điệp của Meta rất đơn giản: mô hình bạn sử dụng để viết mã và điều hành các tác nhân đã trở nên tốt hơn ở những phần không mấy hấp dẫn của công việc — nắm bắt bối cảnh, điều chỉnh kế hoạch của chính nó và biết khi nào cần yêu cầu trợ giúp.

---

Đi trước AI

Nhận tin tức, phân tích và đột phá mới nhất về AI — tất cả ở cùng một nơi.

Đọc thêm tin tức về AI →