Theo công ty đánh giá AI Vals AI, Claude Fable 5.1 của Anthropic đã giải được một mật mã số chưa được giải mã kể từ năm 1653. Câu đố, được gọi là "Cyphral Distich", được Sir Thomas Urquhart xuất bản vào thế kỷ 17 và bao gồm hai dòng, mỗi dòng có 32 số. Vals AI cho biết mô hình này đã tạo ra giải pháp có thể kiểm chứng được trong 44 phút mà không cần sự trợ giúp của con người.
Kết quả, được báo cáo đầu tiên bởi The Decoder, là một điểm dữ liệu nhỏ nhưng nổi bật trong một cuộc tranh luận đang diễn ra: liệu các mô hình biên giới có thể làm được nhiều việc hơn ngoài việc trả lời các câu hỏi chuẩn - liệu chúng có thực sự thúc đẩy được những nghiên cứu mà con người chưa hoàn thành được không? Đối với độc giả theo dõi những phát triển mới nhất trong nghiên cứu AI, câu trả lời ngày càng có vẻ là có, miễn là mô hình được chỉ ra đúng vấn đề.
Một thông điệp ẩn giấu suốt 373 năm
Cyphral Distich đã chế nhạo những người giải câu đố trong nhiều thế kỷ. Cơ chế, một khi được tiết lộ, rất đơn giản: mỗi con số trong số 32 con số trong hai dòng chỉ đến một từ trong một trong 32 phần trong ấn phẩm của Urquhart. Lấy chữ cái đầu tiên của mỗi từ đã chọn và một lời tuyên bố ẩn giấu về lòng trung thành chính trị sẽ hiện ra:
"Hỡi Chúa, hãy ủng hộ Vua Charls đệ nhị và biến ông ấy thành người cai trị tối cao của vùng đất này."
Thông điệp nằm ngay trong cuốn sách của Urquhart. Rào cản không bao giờ là nơi lưu trữ hay bí mật - đó là sự phỏng đoán kết hợp để tìm ra từ mà mỗi số chỉ ra, không có xác nhận nào cho đến khi toàn bộ chuỗi rơi vào đúng vị trí.
Nhiều tháng thất bại, rồi giải quyết trong 44 phút
Sự đột phá không đến từ một thử thách đơn giản. Theo Vals AI, nhóm đã dành nhiều tháng để thử nghiệm các mô hình biên giới cho các câu đố chưa được giải và không có mô hình nào khác đưa ra giải pháp có thể kiểm chứng được cho bất kỳ câu đố nào trong số đó. Truyện ngụ ngôn 5.1 có một nội dung ngắn gọn khác, cởi mở hơn: tự mình tìm ra một câu đố có thể giải được.
Mô hình này sàng lọc các vấn đề của ứng viên, đánh dấu Cyphral Distich là có triển vọng và sau đó bắt đầu làm việc. Bốn mươi bốn phút sau, nó đã có một giải pháp hoàn chỉnh, có thể kiểm tra được - việc bẻ khóa mật mã đầu tiên có thể kiểm chứng được trong lịch sử 373 năm của nó.
Kiên trì chứ không phải thiên tài
Chi tiết đáng chú ý nhất trong báo cáo là chiến thắng đã diễn ra như thế nào. Trích dẫn Vals AI, The Decode lưu ý rằng Fable 5.1 đã thành công không phải nhờ khả năng phân tích mật mã vượt trội hay hiểu biết sâu sắc về toán học thông minh, mà nhờ thử nghiệm và sai sót có hệ thống cũng như sự kiên trì tuyệt đối. Nhìn lại, giải pháp đủ đơn giản để một con người quyết tâm cũng có thể tìm ra nó.
Việc đóng khung đó rất quan trọng. Ưu điểm của mô hình là sức chịu đựng - khả năng nghiền nát hết giả thuyết này đến giả thuyết khác mà không mệt mỏi, thất vọng hoặc tin chắc rằng một câu đố là không thể giải được. Những người giải mã con người đã từ bỏ Cyphral Distich không phải vì họ thiếu trí thông minh để giải nó, mà vì những nỗ lực thất bại hàng thế kỷ không mang lại phần thưởng cho một lần thử nữa. Một đặc vụ AI không cảm thấy chán nản như vậy.
Nó nói gì về AI như một công cụ nghiên cứu
Các nhà sử học, nhà cổ điển và nhà lưu trữ ngày càng thử nghiệm máy học để đọc các bản thảo bị hư hỏng, tái tạo lại các văn bản bị phân mảnh và kiểm tra các diễn giải trên quy mô lớn. Tập Cyphral Distich bổ sung thêm một điểm mới: AI không gặp phải vấn đề về dữ liệu được định dạng trước. Nó được yêu cầu khảo sát các vấn đề mở, đánh giá xem vấn đề nào có thể mang lại kết quả và sau đó cam kết thực hiện nó - một quy trình làm việc trông giống nghiên cứu độc lập hơn là tính toán được hỗ trợ.
Tính kinh tế của quy trình làm việc đó đáng được quan tâm. Đối với một học giả loài người, một thập kỷ nỗ lực tìm kiếm mật mã trong ngõ cụt là một sự nghiệp ở nơi hoang dã. Đối với một tác nhân AI, các giả thuyết thất bại sẽ tiêu tốn điện năng và mã thông báo - và một thành công duy nhất có thể biện minh cho mọi ngõ cụt. Sự bất đối xứng đó làm thay đổi những vấn đề nào đáng được giải quyết. Những câu đố như Cyphral Distich, từng bị coi là không thể giải được một cách khách quan vì không có con người nào có thể duy trì việc tìm kiếm, bỗng nhiên rơi vào danh mục "dự án cuối tuần hợp lý". Các thư viện và kho lưu trữ chứa đầy tài liệu với đặc điểm chính xác như sau: được đóng gói chặt chẽ, có thể kiểm chứng và bị bỏ rơi vì thiếu sức chịu đựng hơn là thiếu tầm quan trọng.
Một ditich, đối với những người bỏ qua lớp thơ Latinh, chỉ đơn giản là một đơn vị thơ hai dòng - đóng góp của Urquhart là thay thế thơ bằng hai dòng thuần số, thách thức hậu thế tái tạo lại văn bản mà họ đã mã hóa. Báo cáo của Người giải mã không nói rõ tại sao Urquhart lại che giấu thông điệp, mặc dù lời cầu nguyện khiêm tốn cho quyền lực tối cao của nhà vua khiến người ta không thể tưởng tượng được ông ta sẽ ủng hộ phe nào trong một thế kỷ đầy nguy hiểm.
Ngoài ra còn có ẩn ý thương mại. Kết quả đến vài ngày sau khi Anthropic ra mắt Fable 5.1, một mô hình mà công ty định vị cho công việc nghiên cứu và mã hóa ở mức giá thấp hơn đáng kể cho việc sử dụng tác nhân. Một cuộc trình diễn công khai về khả năng giải câu đố tự động, trong số những thứ khác, là một bằng chứng đúng lúc về chiêu trò tiếp thị đó.
Câu hỏi xác minh cũng vẫn còn bỏ ngỏ ở một khía cạnh: Vals AI đã công bố giải pháp và lý do đằng sau nó, đây là yếu tố phân biệt một vết nứt thực sự với một phỏng đoán hợp lý. Các từ được đánh vần bằng mật mã tạo thành một câu mạch lạc, có ngữ pháp khớp chính xác với cấu trúc mà các con số ngụ ý - loại ràng buộc mà các giải pháp tình cờ không tồn tại được. Trong thời đại mà các kết quả đầu ra của AI thường xuyên bị chào đón với sự hoài nghi, thì việc sản phẩm này có thể kiểm tra từng chữ một là điều khiến nó đáng được báo cáo.
Điều này không có nghĩa là các mô hình ngôn ngữ sắp thay thế các chuyên gia về miền. Lời giải của mật mã vẫn phải được con người xác minh và phương pháp của mô hình là sự kiên nhẫn đến mức tàn bạo hơn là hiểu biết. Nhưng như một minh chứng cho thấy học thuật được hỗ trợ bởi AI đang hướng tới đâu – những mô hình tự chọn mục tiêu và làm việc mà không bị giám sát cho đến khi có điều gì đó xảy ra – thật khó để tưởng tượng một biểu tượng mang tính văn học hơn một câu đố theo chủ nghĩa bảo hoàng từ năm 1653 cuối cùng đã nhường bí mật của nó cho một cỗ máy.
---
Đi trước AINhận tin tức, phân tích và đột phá mới nhất về AI — tất cả ở cùng một nơi.
Đọc thêm tin tức về AI →