Anthropic đã thông báo rằng họ sẽ đặt chế độ tự động làm mặc định trong Claude Code cho các tài khoản Pro, Max và Team bắt đầu từ ngày 14 tháng 8 năm 2026, một sự thay đổi có nghĩa là đại lý mã hóa AI của công ty sẽ ngày càng hoạt động mà không cần tạm dừng để được con người phê duyệt ở mỗi bước. Quyết định này được TechCrunch đưa tin vào ngày 9 tháng 8 năm 2026 và được đưa tin bởi The New Stack, 9to5Mac và Tech in Asia, là một trong những quyết định táo bạo nhất mà việc giám sát tự động có thể tốt hơn việc xem xét thủ công. Để biết thông tin liên tục về các công cụ AI đang định hình lại quá trình phát triển phần mềm, hãy theo dõi thông tin về ngành AI của chúng tôi.
Sự thay đổi này xác định lại mối quan hệ giữa các nhà phát triển và trợ lý AI của họ. Thay vì đưa ra lời nhắc cấp phép ở mỗi hành động, Claude Code ở chế độ tự động sẽ tự động tiến hành trừ khi nó xác định rằng một hành động là không thể đảo ngược, mang tính phá hoại hoặc nhằm mục đích bên ngoài môi trường của người dùng.
Dữ liệu đằng sau quyết định
Sự biện minh của Anthropic dựa trên một tập hợp các con số đáng kinh ngạc. Trong một nghiên cứu với 1.053 người thử nghiệm trả phí, công ty báo cáo rằng chế độ tự động phát hiện được 89% hành động có hại, trong khi đánh giá thủ công của con người chỉ phát hiện được 13,6%. Anthropic lập luận rằng khoảng cách này phản ánh điểm yếu cơ bản trong cách mọi người giám sát AI: người dùng phê duyệt khoảng 97% lời nhắc cấp phép trong Mã Claude, biến việc xem xét thủ công thành một con dấu cao su phản xạ một chút.
Như công ty đã giải thích trong thông báo của mình vào ngày 8 tháng 8, việc xem xét thủ công có thể trở thành thói quen đến mức vô dụng. Khi các nhà phát triển bị gián đoạn hàng chục lần mỗi phiên, chi phí nhận thức của việc đánh giá cẩn thận từng lời nhắc sẽ đủ cao để hầu hết mọi người chỉ cần nhấp vào phê duyệt. Quan điểm của Anthropic là một hệ thống tự động được thiết kế tốt, không làm con người mệt mỏi và mất tập trung, thực sự có thể an toàn hơn trong thực tế.
Trưởng bộ phận mã Claude, Boris Cherny đã viết trên X rằng anh ấy và nhóm của mình chỉ sử dụng chế độ tự động và đã làm như vậy trong nhiều tháng, đồng thời nói thêm rằng anh ấy không thể tưởng tượng được việc quay lại các lời nhắc về quyền.
Chế độ tự động thực sự thay đổi những gì
Claude Code là tác nhân môi trường phát triển tích hợp và dòng lệnh của Anthropic, được thiết kế để viết, chỉnh sửa và thực thi mã trong dự án của nhà phát triển. Ở chế độ thủ công, công cụ sẽ tạm dừng trước khi thực hiện các hành động chạm vào hệ thống tệp, chạy lệnh hoặc thực hiện các yêu cầu mạng, chờ sự đồng ý rõ ràng của người dùng.
Ở chế độ tự động, tác nhân hoạt động với quyền tự chủ cao hơn nhiều. Nó sẽ ghi tệp, chạy thử nghiệm, cài đặt các phần phụ thuộc và thực thi các tập lệnh mà không cần dừng lại để hỏi — trừ khi các biện pháp bảo vệ tích hợp sẵn của nó gắn cờ một hoạt động là có khả năng gây hại. Anthropic đã coi đây là sự cân bằng giữa tốc độ và sự an toàn, lập luận rằng khả năng di chuyển nhanh mà không bị gián đoạn liên tục là điều khiến các tác nhân mã hóa AI thực sự hữu ích.
Công ty cho biết họ đã song song bổ sung các tính năng an toàn, bao gồm sàng lọc tiêm nhắc nhanh chóng và các quy tắc từ chối cứng có thể tùy chỉnh cho phép các tổ chức chặn các danh mục hành động cụ thể, chẳng hạn như nỗ lực lọc dữ liệu.
Tỷ lệ bỏ lỡ 11% và các nhà phê bình của nó
Quyết định này đã thu hút sự xem xét kỹ lưỡng. Như Tech in Asia và các hãng khác đã lưu ý, tỷ lệ bắt được 89% của chế độ tự động có nghĩa là khoảng 11% hành động có hại lọt qua — một tỷ lệ bỏ lỡ khiến một số nhà phát triển và chuyên gia bảo mật phải tạm dừng. Khi một tác nhân tự trị có thể viết và thực thi mã, ngay cả một tỷ lệ nhỏ các hành động có hại không được kiểm tra cũng có thể gây ra hậu quả thực sự, từ việc xóa tệp cho đến đưa lỗ hổng vào hệ thống sản xuất.
Lập luận phản bác của Anthropic là sự so sánh có liên quan không phải là sự hoàn hảo mà là sự thay thế thực tế. Nếu người đánh giá phát hiện được ít hơn 14% hành động có hại trong thực tế thì hệ thống tự động phát hiện được 89% thể hiện sự cải thiện đáng kể — ngay cả khi nó không hoàn hảo. Cuộc tranh luận đề cập đến một câu hỏi sâu sắc hơn về an toàn AI: liệu tiêu chuẩn cho các hệ thống tự trị có phải là sự hoàn hảo hay đơn giản là tốt hơn rõ rệt so với tiêu chuẩn cơ bản của con người mà chúng thay thế.
Sự chuyển đổi rộng hơn sang AI tác nhân
Thay đổi mặc định của Mã Claude phản ánh một phong trào toàn ngành hướng tới AI tác nhân - các hệ thống thực hiện hành động trong thế giới thực thay vì chỉ tạo ra văn bản. OpenAI, Google và nhiều công ty khởi nghiệp đang xây dựng các tác nhân duyệt web, quản lý cơ sở dữ liệu và kiểm soát ứng dụng. Mỗi sản phẩm này đều phải đối mặt với căng thẳng cơ bản giống nhau giữa quyền tự chủ và giám sát.
Đặt tự động hóa làm mặc định là một tín hiệu có ý nghĩa. Nó gợi ý rằng ít nhất một phòng thí nghiệm AI lớn tin rằng công nghệ này đã đủ trưởng thành để năng suất đạt được lớn hơn những rủi ro còn sót lại và người dùng sẽ thích nghi với một thế giới nơi các công cụ AI của họ hoạt động trước và giải thích sau.
Ý nghĩa đối với Nhà phát triển và Nhóm
Đối với các nhóm phát triển, sự thay đổi này mang ý nghĩa thiết thực. Chế độ tự động hứa hẹn quy trình làm việc nhanh hơn đáng kể, đặc biệt đối với các tác vụ lặp đi lặp lại như dự án giàn giáo, viết bản soạn sẵn và chạy bộ thử nghiệm. Nhưng nó cũng chuyển gánh nặng an toàn sang cấu hình - các nhóm sẽ cần đầu tư thời gian vào việc thiết lập các quy tắc từ chối cứng và hiểu những gì đại lý của họ được phép làm mà không bị giám sát.
Đặc biệt, khách hàng doanh nghiệp có thể phải đối mặt với áp lực phải chính thức hóa các chính sách xung quanh việc thực thi mã tự động, cân bằng lợi ích về tốc độ với các yêu cầu về tuân thủ và bảo mật.
Đi trước AI
Quá trình chuyển đổi từ trợ lý AI gợi ý sang tác nhân hành động là một trong những thay đổi mang tính hệ quả nhất trong phát triển phần mềm hiện nay. Để có báo cáo rõ ràng, có nguồn gốc về các công cụ, công ty và các cuộc tranh luận thúc đẩy ngành AI phát triển, hãy đánh dấu trang chủ của chúng tôi và đọc thêm tin tức về AI tại https://aibuzzwire.news.
