Theo phân tích mới từ nền tảng điểm chuẩn Arena, Claude Opus 5.5 của Anthropic đã loại bỏ tất cả dấu gạch ngang, một trong những dấu gạch ngang dễ nhận biết nhất của văn bản do AI tạo ra. Mô hình hiện sử dụng dấu gạch ngang ít hơn khoảng 95% so với phiên bản trước, viết bằng các câu ngắn hơn và sử dụng cách diễn đạt đơn giản hơn. Có một sự đánh đổi đáng chú ý: câu trả lời của nó ngày càng dài hơn.
Những phát hiện này đến từ phân tích của Arena về các câu trả lời có tính lý luận cao được thu thập thông qua Text Arena trong khoảng thời gian từ tháng 8 đến tháng 9 năm 2026, theo báo cáo của BleepingComputer. Trong số mười hai biện pháp viết mà Arena theo dõi, mười biện pháp đã di chuyển theo hướng mà nền tảng này coi là hướng tốt hơn so với Claude Opus 5. For more context on this story, see our ongoing more AI stories.
Những con số đằng sau sự thay đổi phong cách của Claude
Thống kê tiêu đề là sự sụp đổ của dấu gạch ngang em. Theo dữ liệu của Arena, Opus 5 sử dụng 15,2 dấu gạch ngang trên 1.000 từ, trong khi Opus 5.5 giảm con số đó xuống chỉ còn 0,8, giảm khoảng 95%.
Dấu chấm phẩy, một thói quen chấm câu khác thường được gắn cờ là giống máy, cũng giảm mạnh, từ 6,10 xuống 1,64 trên 1.000 từ. Cấu trúc câu đã thay đổi cùng với dấu câu: câu trung bình trong phản hồi Opus 5.5 hiện có 10,03 từ, giảm so với 12,14 từ của Opus 5, với phân tích cũng lưu ý rằng các lựa chọn từ đơn giản hơn và ít câu dài, xếp chồng mệnh đề đã trở thành đặc trưng của các mô hình trước đó.
Tập dữ liệu của Arena tập trung vào các phản hồi có tính logic cao từ Text Arena trong khoảng thời gian hai tháng, điều đó có nghĩa là việc so sánh nằm trong phạm vi cài đặt đánh giá cụ thể thay vì sử dụng hàng ngày. Mặc dù vậy, hướng thay đổi vẫn nhất quán trên hầu hết các biện pháp mà nền tảng theo dõi.
Tại sao Em Dash trở thành thẻ điện thoại của AI
Em dash chiếm một vị trí xa lạ trong văn hóa viết AI. Trong nhiều năm, sự rải rác dày đặc các dấu gạch ngang đã được độc giả, biên tập viên và máy dò AI tự phong coi là dấu hiệu nhận biết của văn xuôi do máy tạo ra, đến mức dấu chấm câu trở thành tốc ký cho hiện tượng rộng hơn về nội dung do máy sản xuất, chất lượng thấp, thường bị coi là "lỗi AI".
Liệu khuôn mẫu có từng là một tín hiệu đáng tin cậy hay không vẫn còn gây tranh cãi, vì rất nhiều nhà văn con người sử dụng dấu gạch ngang một cách tự do và nhiều văn bản AI đã tránh chúng. Nhưng nhận thức rất quan trọng, đặc biệt đối với các doanh nghiệp sử dụng mô hình ngôn ngữ lớn để soạn thảo bản sao, tài liệu và bài báo tiếp thị và không muốn đầu ra của họ được hiểu là tổng hợp một cách rõ ràng.
Trong bối cảnh đó, một mô hình tránh được khuôn mẫu đó một cách rõ ràng sẽ có một điểm bán hàng thực tế. Như BleepingComputer đã quan sát trong báo cáo của mình, việc Opus 5.5 giảm sự phụ thuộc vào các mẫu viết AI rõ ràng có nghĩa là người dùng ít có khả năng tạo ra văn bản đọc dưới dạng đầu ra chung của máy.
Sự đánh đổi: Câu ngắn hơn, câu trả lời dài hơn
Một biện pháp đã đi sai hướng là tính dài dòng. Theo con số của Arena, độ dài câu trả lời trung bình cho Opus 5.5 đã tăng từ 453 từ lên 481 từ so với Opus 5, khiến nó trở thành mẫu Opus có thời gian viết dài nhất trong so sánh.
Điều đó có vẻ giống như một mức tăng nhỏ, nhưng nó đi ngược lại xu hướng rộng hơn của ngành hướng tới kết quả đầu ra mô hình trực tiếp hơn, ngắn gọn hơn và điều đó có nghĩa là người dùng đốt mã thông báo trong lệnh gọi API có thể trả nhiều hơn một chút cho cùng một nội dung. Những câu ngắn hơn kết hợp với những câu trả lời dài hơn cũng hàm chứa nhiều câu trả lời hơn: mô hình đang chia văn xuôi thành những phần nhỏ hơn trong khi nói một cách tổng thể hơn.
Tất nhiên, tính dài dòng không tự động là một thiếu sót. Đối với các nhiệm vụ như giải thích, tài liệu hóa và phân tích, một vài câu bổ sung có thể làm rõ ràng hơn. Để có câu trả lời nhanh hoặc khối lượng công việc nhạy cảm với chi phí, đây là một xu hướng đáng theo dõi.
Ý nghĩa của nó đối với người viết, biên tập viên và công cụ phát hiện
Phân tích này là lời nhắc nhở rằng dấu vân tay thống kê của văn bản AI là mục tiêu đang di chuyển. Các công cụ và phương pháp phỏng đoán được xây dựng để gắn cờ dấu gạch ngang, thói quen dấu chấm phẩy hoặc độ dài câu sẽ bị suy giảm khi các phòng thí nghiệm cố tình điều chỉnh các mẫu đó đi, để cải thiện khả năng đọc hay chỉ đơn giản là để thoát khỏi sự kỳ thị gắn liền với chúng.
Nó cũng nhấn mạnh mức độ cạnh tranh giữa các mô hình tiên phong đã chuyển sang những phẩm chất khó nắm bắt được trong các tiêu chuẩn truyền thống. Dữ liệu của Arena cho thấy Anthropic đang chú ý đến cách mô hình của nó viết chứ không chỉ cách nó viết mã. BleepingComputer lưu ý rằng Opus 5.5 được coi là một trong những mô hình mã hóa mạnh nhất và chất lượng viết đã trở thành một điểm khác biệt nhỏ hơn trong một thị trường nơi hầu hết các so sánh công khai đều xoay quanh việc đánh giá tác nhân và lập trình.
Một Thay Đổi Nhỏ Với Dấu Chân Rõ Ràng
Không ai đọc bảng điểm chuẩn và thay đổi văn xuôi của họ. Nhưng nhân với khối lượng văn bản khổng lồ mà các mô hình ngôn ngữ lớn hiện tạo ra hàng ngày, việc sử dụng dấu gạch ngang giảm 95% là loại thay đổi có thể nhìn thấy rõ ràng trong tự nhiên, như báo cáo đã đưa ra, ngày càng ít dấu gạch ngang trên Internet.
Hiện tại, những điều cần rút ra rất đơn giản. Claude Opus 5.5 viết với ít thói quen chấm câu liên quan đến văn bản do AI tạo ra, giữ câu ngắn hơn và sử dụng các từ đơn giản hơn so với phiên bản tiền nhiệm. Nó cũng nói nhiều hơn một chút. Liệu sự kết hợp đó có đọc tốt hơn hay không là sự đánh giá của người dùng cá nhân, nhưng đó là một ví dụ cụ thể, có thể đo lường được về việc các phòng thí nghiệm đang tích cực định hình lại âm thanh của văn bản máy.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →