OpenAI đã vén bức màn về Astra, một hệ thống chưa được phát hành mà nó gọi là "mô hình chính tiếp theo của chúng tôi", sau khi một phiên bản nội bộ tạo ra mười tiến bộ đáng kể trong toán học và khoa học máy tính lý thuyết. Công ty đã giấu thông báo này bên trong một bài đăng nghiên cứu ghi lại các kết quả toán học, khiến các nhà nghiên cứu theo dõi chặt chẽ tin nóng về AI vừa phấn khích vừa xem xét kỹ lưỡng.

OpenAI viết: Các vấn đề mà Astra giúp crack đã cho thấy “không có tiến triển nào về kết quả trung tâm của họ trong ít nhất một thập kỷ và trong hầu hết các trường hợp là lâu hơn nữa”. Các kết quả trải rộng trên các lĩnh vực bao gồm hình học nhiều chiều, lý thuyết mã hóa, độ phức tạp của mạch số học, lý thuyết nhóm, độ phức tạp lượng tử, mật mã mạng và tổ hợp cực trị - lĩnh vực mà tiến độ thường được đo bằng năm chứ không phải các nghiên cứu đơn lẻ.

Bằng chứng đã được xác minh, không chỉ là câu trả lời

Điều khác biệt giữa kết quả đầu ra của Astra với việc đoán toán của chatbot là tính năng xác minh. OpenAI cho biết các nhà nghiên cứu con người đã sử dụng mô hình tương tự để chuẩn bị các lập luận dưới dạng bản thảo và Astra sau đó chính thức hóa mọi lập luận dưới dạng Chứng chỉ Lean. Lean là một trợ lý chứng minh nguồn mở có thể kiểm tra các lập luận toán học bằng máy, nghĩa là các nhà toán học khác không cần phải tin tưởng vào kết quả - chúng có thể được xác minh độc lập bằng phần mềm trong vài giây.

Sự khác biệt đó rất quan trọng. Một mô hình ngôn ngữ có thể tạo ra một bằng chứng trông có vẻ hợp lý nhưng lại chứa đựng một lỗi nghiêm trọng, tinh vi. Bằng cách chuyển từng đối số sang Lean, OpenAI đã chuyển đổi một tuyên bố tiếp thị thành một tạo phẩm có thể kiểm tra được. Theo BleepingComputer, nơi đã báo cáo chi tiết, những tiến bộ cụ thể bao gồm bằng chứng chứng minh sự tồn tại của các nhóm phi xã hội học, giải quyết một câu hỏi mở lớn trong lý thuyết nhóm; bác bỏ giả thuyết cứng nhắc của Connes; giới hạn mới cho việc đóng gói hình cầu có chiều cao; và kết quả là giải quyết được một số vấn đề do nhà toán học nổi tiếng Paul Erdős đặt ra.

OpenAI lưu ý rằng tổng số token cần thiết để tìm ra các giải pháp này sẽ có giá khoảng 2.000 USD theo tỷ giá API hiện tại — một điểm dữ liệu nổi bật về dấu chân điện toán của khám phá toán học hiện đại và là một điểm đặt nghiên cứu cấp độ tiên phong trong tầm tay của các nhóm học thuật được tài trợ tốt thay vì chỉ riêng các phòng thí nghiệm.

Phản ứng của các nhà toán học

Thomas Bloom, một nhà toán học tại Đại học Manchester, người điều hành trang web tham khảo bài toán Erdős erdosproblems.com, đã gọi các kết quả này là "tin tức lớn" về X, theo The Decode. Ông đánh giá chúng có ý nghĩa hơn một ví dụ phản biện cho giả thuyết khoảng cách đơn vị được công bố vào tháng Năm. Bloom viết: “Có thể không lớn hơn bằng chứng về khoảng cách đơn vị, nhưng xét về mặt công trình, điều này là lớn”.

Bloom cũng phản đối quan điểm cho rằng AI đang thay thế các nhà toán học, cho rằng tuyên bố này không có ý nghĩa gì khi hệ thống này dựa trên hơn một thế kỷ lý thuyết, được xây dựng bởi các nhà toán học và được đào tạo về mọi thứ mà các nhà toán học từng viết.

Noam Brown, nhà nghiên cứu đằng sau công nghệ lý luận trong thời gian thử nghiệm mà Astra dựa vào, đã đo lường nhiều hơn. “Đáng buồn thay, chưa có bài toán Giải thưởng Thiên niên kỷ nào,” ông đăng trên X, đề cập đến bảy bài toán nổi tiếng mà Viện Toán học Clay treo giải 1 triệu USD cho mỗi bài - chỉ có một bài được giải kể từ khi giải thưởng được công bố vào năm 2000.

Không phải ai cũng ấn tượng. Nhà phê bình AI Gary Marcus đã gọi mô hình này là "tuyệt vời - nhưng được bán quá mức" trong một bài đăng trên Substack, một dòng hoài nghi quen thuộc mỗi khi một phòng thí nghiệm biên giới tuyên bố một cột mốc quan trọng. Sự căng thẳng giữa thành tựu kỹ thuật thực sự và khung quảng cáo có thể sẽ xác định cách đón nhận Astra.

Một gia đình kiểu mẫu mới cho những nhiệm vụ lâu dài

Thông tin đã xác nhận một cách độc lập rằng Astra là dòng mô hình mới được xây dựng cho khối lượng công việc dài hạn. OpenAI mô tả nó như một hệ thống cho phép nhiều tác nhân AI cộng tác trên các phần khác nhau của một vấn đề lớn hơn - một thiết kế nhắm thẳng vào các nhiệm vụ mất hàng giờ hoặc hàng ngày thay vì vài giây, chẳng hạn như chứng minh một định lý hoặc tái cấu trúc một cơ sở mã lớn.

BleepingComputer báo cáo rằng OpenAI vẫn chưa quyết định liệu mô hình này sẽ xuất xưởng dưới dạng GPT-5.7, GPT-6 hay dưới một tên khác. Giám đốc điều hành Sam Altman đã giới thiệu Astra ở Washington, D.C., The Decoding đưa tin, báo hiệu rằng công ty coi hệ thống này đã đủ trưởng thành để đưa ra trước các nhà hoạch định chính sách.

Rào cản đánh giá của Chính phủ

Có lẽ chi tiết quan trọng nhất là quy định. Theo The Decoding, Astra sẽ là một trong những mẫu xe đầu tiên trải qua quá trình xem xét theo kế hoạch của chính phủ Hoa Kỳ, quy trình này cần có sự chấp thuận chính thức trước khi phát hành rộng rãi. Điều đó tạo thêm một lớp bất ổn chính trị cho lịch trình ra mắt mà các mẫu máy hàng đầu trước đó chưa từng phải đối mặt — và đặt ra mối quan ngại về cách OpenAI mô tả các khả năng của Astra.

Màn ra mắt cũng diễn ra trong bối cảnh cuộc đua hạng cân mở khốc liệt. Vài ngày trước đó, Phòng thí nghiệm Máy Tư duy đã phát hành mô hình trọng lượng mở Inkling-Small và các phòng thí nghiệm Trung Quốc tiếp tục thúc đẩy các hệ thống biên giới trọng lượng mở. Astra báo hiệu sự đặt cược của OpenAI rằng lý luận độc quyền, quy mô lớn — được xác minh bằng các công cụ như Lean — vẫn là con đường dẫn đến những đột phá lớn nhất.

Hiện tại, Astra vẫn chưa được phát hành. Nhưng lần ra mắt toán học đầu tiên của nó đã điều chỉnh lại cuộc trò chuyện về những hệ thống AI tiên tiến nào có thể đóng góp cho khoa học thuần túy và công chúng nên xem xét kỹ lưỡng những tuyên bố đi kèm với chúng như thế nào.

Đi trước AI

Bạn muốn theo kịp sự phát triển như Astra và cuộc đua mô hình biên giới rộng hơn? Đánh dấu trung tâm của chúng tôi để biết những phát triển AI mới nhất.

Đọc thêm tin tức về AI →