Anthropic đã thông báo vào ngày 9 tháng 8 năm 2026 rằng họ sẽ đặt chế độ tự động làm mặc định cho đại lý lập trình Claude Code của mình, triển khai cho các tài khoản Pro, Max và Team bắt đầu từ ngày 14 tháng 8. Thay đổi này sẽ loại bỏ các lời nhắc cấp phép liên tục hiện đang làm gián đoạn các phiên mã hóa, cho phép tác nhân tiến hành một cách tự động trừ khi một hành động được cho là không an toàn.

Công ty lần đầu tiên công bố phiên bản thử nghiệm của chế độ tự động vào tháng 3 năm 2026, giới thiệu nó như một cách để cân bằng tốc độ và khả năng kiểm soát trong quá trình mã hóa tác nhân. Để biết bối cảnh rộng hơn về cách các công cụ AI đang định hình lại hoạt động phát triển phần mềm, hãy xem những phát triển AI mới nhất của chúng tôi.

Cách thức hoạt động của chế độ tự động

Khi Mã Claude hoạt động ở chế độ tự động, nó không còn đưa ra lời nhắc yêu cầu sự chấp thuận của con người ở mỗi bước. Thay vào đó, tác nhân sẽ tự tiến hành trừ khi một hành động được xác định là "không thể đảo ngược, phá hoại hoặc nhằm mục đích bên ngoài môi trường của bạn."

Điều đó có nghĩa là các thao tác chỉnh sửa, thao tác tệp và tác vụ dòng lệnh thường xuyên không bị gián đoạn, trong khi hệ thống được thiết kế để tạm dừng trước bất kỳ điều gì có thể gây ra thiệt hại thực sự — chẳng hạn như xóa dữ liệu, chạy các lệnh phá hoại hoặc tiếp cận các hệ thống ngoài phạm vi thiết lập cục bộ của nhà phát triển.

Anthropic coi sự thay đổi này là một phản ứng thiết thực đối với cách mọi người thực sự sử dụng công cụ này.

Dữ liệu đằng sau quyết định

Chi tiết nổi bật nhất trong thông báo của Anthropic là một nghiên cứu mà công ty thực hiện với 1.053 người thử nghiệm được trả tiền. Theo công ty, chế độ tự động phát hiện được 89% hành động có hại, trong khi đánh giá thủ công của con người chỉ phát hiện được 13,6%.

Anthropic gợi ý lời giải thích là sự cảnh giác của con người suy giảm nhanh chóng trong các phiên mã hóa lặp đi lặp lại. Công ty lưu ý rằng người dùng phê duyệt khoảng 97% lời nhắc về quyền trong Mã Claude - có nghĩa là lời nhắc phần lớn đã trở thành một con tem cao su hơn là một kiểm tra an toàn có ý nghĩa.

Phát hiện của công ty ngụ ý: “Khi việc xem xét thủ công trở thành thói quen, nó sẽ không còn là một biện pháp bảo vệ nữa”. Bằng cách tự động hóa ranh giới an toàn với các quy tắc xác định thay vì dựa vào việc nhà phát triển nhấp vào "có" lần thứ một trăm, Anthropic lập luận rằng nó thực sự có thể giảm thiểu rủi ro.

##Rào chắn an toàn mới

Bên cạnh việc chuyển đổi mặc định, Anthropic cho biết họ đã bổ sung thêm các tính năng an toàn mới cho Claude Code, bao gồm:

  • Sàng lọc tiêm nhắc nhở, được thiết kế để phát hiện các nỗ lực thao túng tác nhân thông qua các hướng dẫn độc hại được nhúng trong mã hoặc tài liệu.
  • Quy tắc từ chối cứng có thể tùy chỉnh, cho phép các tổ chức chặn hoàn toàn các danh mục hành động cụ thể — chẳng hạn như lọc dữ liệu hoặc ghi vào các thư mục nhạy cảm.

Các biện pháp kiểm soát này nhằm cung cấp cho các nhóm cách thiết lập các ranh giới chắc chắn mà tổng đài viên không thể ghi đè, ngay cả ở chế độ tự động.

Đặt cược vào mã hóa đại lý

Trưởng bộ phận mã Claude Boris Cherny cho biết trong một bài đăng trên X rằng nhóm đã chỉ sử dụng chế độ tự động trong nhiều tháng. “Tôi không thể tưởng tượng được việc quay trở lại với những lời nhắc về quyền,” anh viết.

Thay đổi mặc định phản ánh sự đặt cược rộng hơn của toàn ngành rằng tương lai của việc phát triển phần mềm là có tác nhân — với các tác nhân AI xử lý các tác vụ nhiều bước mà chỉ cần nắm tay tối thiểu. OpenAI, Meta và những công ty khác đều đã đi theo cùng một hướng, xây dựng các tác nhân mã hóa được thiết kế để hoạt động tự chủ hơn bên trong các kho lưu trữ và thiết bị đầu cuối.

Đặt chế độ tự động làm mặc định là sự leo thang có ý nghĩa của việc đặt cược đó. Nó chuyển hoạt động tự chủ từ thử nghiệm chọn tham gia sang trải nghiệm tiêu chuẩn dành cho khách hàng trả tiền của Anthropic, nhóm bao gồm các nhà phát triển cá nhân và các nhóm doanh nghiệp lớn.

Một bối cảnh cạnh tranh trở nên có tính chất tác nhân

Anthropic không hề đơn độc trong việc thúc đẩy các tác nhân mã hóa hướng tới quyền tự chủ cao hơn. Meta gần đây đã ra mắt Muse Code, một tác nhân mã hóa AI được thiết kế để hoạt động trong thiết bị đầu cuối trên các kho lưu trữ lớn. OpenAI và một số công ty khởi nghiệp đã xây dựng các công cụ tương tự nhằm cho phép các tác nhân đọc, chỉnh sửa và chạy mã mà giảm thiểu sự can thiệp của con người. Quỹ đạo chung rất rõ ràng: ngành đang chuyển từ hỗ trợ kiểu tự động hoàn thành sang các hệ thống có thể thay mặt nhà phát triển thực hiện hành động có ý nghĩa.

Điều làm nên sự khác biệt của Anthropic là sự sẵn sàng biến quyền tự chủ thành mặc định thay vì chọn tham gia. Hầu hết các công cụ cạnh tranh vẫn yêu cầu người dùng chủ động kích hoạt các chế độ rảnh tay nhất của họ. Bằng cách chuyển đổi công tắc cho tất cả các tài khoản thanh toán, Anthropic đang đưa ra tuyên bố tự tin rằng các biện pháp bảo vệ của nó đủ mạnh để có thể tin tưởng ngay lập tức — đồng thời thu thập dữ liệu trong thế giới thực để chứng minh hoặc bác bỏ tuyên bố đó trên quy mô lớn.

Câu hỏi về niềm tin

Sự thay đổi này cũng đặt ra câu hỏi về việc các nhà phát triển giám sát sẵn sàng nhượng bộ bao nhiêu. Trong khi dữ liệu của Anthropic cho thấy các rào chắn tự động hoạt động tốt hơn so với đánh giá theo thói quen của con người, các nhà phê bình đã cảnh báo rằng mặc định định hình hành vi - và mặc định giả định quyền tự chủ có thể lặng lẽ bình thường hóa mức độ rủi ro mà các nhóm chưa tính toán đầy đủ.

Lập luận phản bác của Anthropic là giải pháp thay thế - một lời nhắc cấp phép mà hầu hết mọi người đều bỏ qua - là nơi bảo mật kém hơn một hệ thống tự động với các quy tắc rõ ràng, có thể thực thi được.

Hiện tại, công ty đang bỏ tiền vào máy. Bắt đầu từ ngày 14 tháng 8, Claude Code sẽ tin tưởng vào phán đoán của chính mình trước cú nhấp chuột theo phản xạ của một nhà phát triển mệt mỏi.

Đi trước AI

Nhận thông tin mới nhất về ngành AI →

Các công cụ mã hóa AI đang phát triển nhanh chóng. Đọc thêm tin tức về AI →