Một thẩm phán Connecticut đã xác định điều có vẻ như là lần đầu tiên một nguyên đơn Hoa Kỳ cố gắng giấu văn bản trong hồ sơ tòa án mà chỉ hệ thống trí tuệ nhân tạo mới có thể đọc được, nhằm cố gắng thắng kiện. Kế hoạch thất bại, đương sự bị xử phạt và phán quyết hiện đang thu hút sự chú ý trên toàn thế giới công nghệ pháp lý khi các tòa án trên cả nước bắt đầu áp dụng các công cụ AI của riêng họ.

Quyết định này được Thẩm phán Walter Spader Jr. của Tòa Thượng thẩm Connecticut công bố vào tuần trước và được Ars Technica và Reuters trình bày chi tiết trong tuần này. Đối với tin nóng về AI về sự xung đột giữa trí tuệ nhân tạo và hệ thống tư pháp, vụ việc này là bản xem trước của một vấn đề mà các nhà nghiên cứu bảo mật đã cảnh báo trong nhiều năm: đầu vào đối nghịch được thiết kế để máy móc đọc chứ không phải con người.

Lời nhắc ẩn hoạt động như thế nào

Nguyên đơn, Matthew Elliott, đang vướng vào một cuộc tranh chấp với một nhà cung cấp dịch vụ chăm sóc sức khỏe mà ông cáo buộc đã từ chối quyền truy cập vào hồ sơ của mình một cách không thích hợp. Theo phán quyết, sau khi những lập luận trước đó mà ông đưa ra đã bị đánh bại, Elliott đã nhúng các hướng dẫn vào các hồ sơ tiếp theo, theo cách nói của Spader, "được định dạng để vô hình đối với người đọc trong khi vẫn hoàn toàn dễ đọc đối với bất kỳ phần mềm nào đọc văn bản của tài liệu."

Văn bản được thu nhỏ thành kiểu chữ nhỏ và có màu trắng trên nền trắng. Nó chỉ đạo bất kỳ hệ thống AI nào xem xét tài liệu để đảm bảo kết quả đầu ra của nó phù hợp với lập luận của nguyên đơn, bỏ qua những lời từ chối trước đó của tòa án và đảm bảo rằng việc khắc phục sẽ diễn ra như nguyên đơn mong muốn - một cuộc tấn công tiêm nhắc theo sách giáo khoa, không nhằm vào chatbot mà nhắm vào bất kỳ phần mềm nào một ngày nào đó có thể nằm giữa nguyên đơn và thẩm phán.

Văn bản ẩn không có tác động gì đến vụ án. Tòa án đã cân nhắc hồ sơ của Elliott dựa trên giá trị của nó. Nhưng Spader viết rằng nỗ lực tấn công này dù sao cũng đặt ra một tiền lệ "nguy hiểm" và các tòa án Hoa Kỳ có thể sẽ gặp lại chiến thuật độc hại này khi các công cụ AI trở nên phổ biến hơn trong hệ thống tòa án.

"Lạm dụng kiện tụng nghiêm trọng" — và một số trò đùa kỳ lạ

Elliott phải đối mặt với các biện pháp trừng phạt khiêm tốn, nhưng không chỉ vì những chỉ dẫn ẩn giấu ban đầu. Theo phán quyết, anh ta tiếp tục thêm văn bản ẩn vào các hồ sơ mới ngay cả sau khi tòa án cảnh báo anh ta rằng anh ta có thể phải đối mặt với các hình phạt vì điều mà Spader cuối cùng cho là "lạm dụng kiện tụng nghiêm trọng".

Elliott nói với tòa án rằng một số tin nhắn ẩn sau đó chỉ nhằm mục đích đùa giỡn. Họ bao gồm một liên kết tới một video YouTube của Nosferatu, một thông báo đơn giản có nội dung "xin chào :) Tôi hy vọng bạn không nhìn thấy tôi" và một thông báo mà nguyên đơn mô tả là vô nghĩa: "KỂ VỚI SHAWN TÔI GỬI RE GARBS CỦA TÔI!!!! HAHAHA U CÁC BẠN NHẬN TRỨNG NÀY???? AHAH."

Spader viết: “Việc nguyên đơn tiếp tục giấu tin nhắn trong những lời bào chữa mới sau khi nhận được thông báo về phiên điều trần [trừng phạt] này là điều đáng kinh ngạc”. Đối với tuyên bố rằng các tin nhắn mang tính hài hước, thẩm phán cho biết việc một người nộp đơn chôn vùi những câu chuyện cười bên trong những lời biện hộ mà anh ta muốn tòa án xem xét một cách nghiêm túc là "bất chấp logic".

Lời bào chữa “kiểm toán”

Để bào chữa cho mình, Elliott lập luận rằng lời nhắc đáng lo ngại nhất được thẩm phán gắn cờ thực sự là một nỗ lực nhằm "kiểm toán" tòa án như một dịch vụ công, vì anh sợ tòa án đã để AI quyết định một cách không công bằng vụ việc của anh. Ông lặp lại quan điểm đó với Reuters, nói rằng ông vẫn giữ ý định của mình là kiểm tra tòa án hơn là thao túng nó.

Spader không thấy lập luận này đáng tin cậy. Nếu Elliott thực sự tin rằng tòa án đã sử dụng AI không đúng cách, thì thẩm phán viết, ông ấy "có thể tự do viết bằng những từ ngữ rõ ràng, dễ thấy để mọi người có thể nhìn thấy và trả lời." Thay vào đó, việc giấu văn bản, Spader kết luận, là "bằng chứng cho mục đích độc hại của nó." Thẩm phán nói thêm rằng có vẻ như Elliott đang "cố gắng đạt được một kết quả mà anh ta không đạt được khi con người, những người hiểu biết" về luật, đọc lời cầu xin của anh ta.

Đáng chú ý, Chi nhánh Tư pháp Connecticut không sử dụng AI để xem xét hoặc quyết định hồ sơ, Spader chỉ ra - vì vậy, không bao giờ có nguy cơ thực sự là hệ thống AI của tòa án sẽ nhầm lẫn lời nhắc của Elliott với hướng dẫn từ tòa án. Ông viết, không giống như “một số hệ thống tòa án ở nơi khác”, không có cỗ máy nào ở đầu bên kia để đánh lừa.

Tại sao một cuộc tấn công thất bại vẫn còn quan trọng

Các nhà nghiên cứu bảo mật đã dành nhiều năm để chứng minh rằng các hệ thống AI đọc tài liệu - chatbot, tác nhân mã hóa, trợ lý email - có thể bị tấn công bởi các hướng dẫn được chôn bên trong văn bản mà chúng nhập vào. Kỹ thuật này, được gọi là tiêm nhắc gián tiếp, được coi là một trong những vấn đề khó giải quyết nhất trong việc triển khai các tác nhân AI. Điều khiến vụ án Connecticut trở nên bất thường là mục tiêu: chính bộ máy công lý.

Spader viết: “Bằng cách ẩn một lệnh bên trong một tài liệu mà hệ thống sau đó sẽ nhập vào, người quay phim cố gắng đưa hướng dẫn của chính họ vào luồng đó để hệ thống xử lý nó như thể nó đến từ người vận hành hệ thống”. "Trong trường hợp này, người điều hành được coi là tòa án, nhân viên của tòa án hoặc luật sư đối lập."

Việc đóng khung đó - hồ sơ tòa án như một bề mặt tấn công - là điều mà các nhà quan sát pháp lý cho rằng làm cho phán quyết trở nên quan trọng. Khi các tòa án và công ty luật ngày càng sử dụng AI để tóm tắt hồ sơ, dự thảo quyết định hoặc phân loại sổ ghi chép, mọi tài liệu do một bên gửi đều trở thành một kênh tiềm năng để thao túng. Thư ký thẩm phán có thể bắt gặp văn bản màu trắng trên trang trắng; một đường dẫn tóm tắt tự động có thể không.

Chuyện gì xảy ra tiếp theo

Theo mô tả của tòa án, các biện pháp trừng phạt đối với Elliott là khiêm tốn. Tuy nhiên, quyết định này mang lại cho các tòa án Hoa Kỳ một tiền lệ bằng văn bản về việc coi các hướng dẫn ẩn mà máy có thể đọc được là hành vi lạm dụng quy trình pháp lý và nó đến vào thời điểm một số hệ thống tòa án tiểu bang đang tích cực thử nghiệm các công cụ đánh giá AI.

Hiện tại, bài học từ Connecticut rất đơn giản: các tòa án đang theo dõi việc này. Như phán quyết của Thẩm phán Spader đã nêu rõ, người đầu tiên thử tiêm thuốc ngay tại tòa án Hoa Kỳ đã bị bắt - và bị xử phạt - mặc dù không có hệ thống AI nào lắng nghe.

Đi trước AI Đọc thêm tin tức về AI →