Các nhà nghiên cứu bảo mật tại Searchlight Cyber đã chứng minh rằng mô hình mã hóa GPT-5.6 của OpenAI có thể phát hiện ra lỗ hổng thực thi mã từ xa nghiêm trọng trong WordPress với chi phí API khoảng 25 USD.
Nghiên cứu được công bố trên trang web của Searchlight Cyber cho thấy rằng một nhà nghiên cứu duy nhất, được trang bị GPT-5.6 Sol Ultra và cơ sở mã WordPress dễ bị tấn công, đã có thể xác định được một chuỗi dẫn từ truy cập xác thực trước cho đến thực thi mã từ xa. Kết quả này trở thành trung tâm của một cuộc tranh luận sôi nổi về tiềm năng tấn công an ninh của các mô hình ngôn ngữ lớn, một chủ đề được theo dõi xuyên suốt những phát triển AI mới nhất.
Một khám phá trị giá 25 đô la trong thị trường trị giá 500.000 đô la
Tiêu đề của nghiên cứu là tính kinh tế rõ ràng của nó. Theo Searchlight Cyber, các nhà môi giới khai thác, những người trung gian mua lỗ hổng và bán lại cho chính phủ và người mua tư nhân, sẽ trả tới 500.000 USD cho một lỗ hổng thực thi mã từ xa đáng tin cậy của WordPress. WordPress chiếm khoảng 40% tổng số trang web, khiến lỗi RCE cốt lõi trở nên cực kỳ có giá trị.
So với tiêu chuẩn đó, khoảng 25 USD mà nhà nghiên cứu đã chi cho các lệnh gọi API GPT-5.6 để tìm ra lỗ hổng là rất đáng chú ý. Công việc không đòi hỏi một đội ngũ lớn, cơ sở hạ tầng làm mờ chuyên dụng hoặc hàng tuần kiểm tra thủ công. Thay vào đó, nó dựa vào việc hướng một mô hình mã hóa có khả năng suy luận về mã nguồn của WordPress từ những nguyên tắc đầu tiên.
Các nhà nghiên cứu đã phát hành một công cụ kiểm tra miễn phí, wp2Shell.com, để quản trị viên có thể xác định xem phiên bản WordPress của họ có bị ảnh hưởng hay không. Họ cho biết họ đã giữ lại các chi tiết công bố đầy đủ để cho những người bảo vệ có thời gian phản hồi.
Làm thế nào mô hình tìm ra lỗ hổng
Trọng tâm của khám phá là hệ thống hook của WordPress, cơ chế mang lại cho nền tảng hệ sinh thái plugin khổng lồ. Các hook, với các tên như `wp_enqueue_scripts` hoặc `publish_post`, cho phép các plugin đính kèm hành vi tùy chỉnh vào hầu hết mọi giai đoạn của vòng đời WordPress. Chúng được chia thành các hành động thực hiện các tác dụng phụ và các bộ lọc để sửa đổi dữ liệu khi nó đi qua.
Tính linh hoạt đó cũng là một bề mặt tấn công trải rộng. Nhiệm vụ mà các nhà nghiên cứu đặt ra là tìm ra một chuỗi cho phép thực thi mã từ xa từ điểm bắt đầu không được xác thực, với thành công được xác định là khả năng đọc tệp được bảo vệ từ hệ thống tệp của máy chủ.
GPT-5.6 Sol Ultra, mô hình mã hóa tập trung vào lý luận của OpenAI, đã thực hiện phân tích bằng cách kiểm tra cách dữ liệu truyền qua các hook của WordPress và đi vào các hoạt động nguy hiểm tiềm tàng. Sức mạnh của mô hình không nằm ở việc tìm kiếm các mẫu một cách mù quáng mà ở khả năng lý luận về sự tương tác giữa các thành phần, một khả năng đã được cải thiện rõ rệt với các phiên bản mô hình tập trung vào lý luận gần đây.
Các nhà nghiên cứu đã xây dựng bài tập xung quanh một kho lưu trữ chứa bản sao dễ bị tấn công của WordPress, một thiết lập giống như thử thách bắt cờ, trong đó thành công có nghĩa là trích xuất một tệp cờ. Nhưng họ nhấn mạnh rằng lớp lỗ hổng cơ bản là có thật và ảnh hưởng đến việc triển khai sản xuất chạy MySQL, cơ sở dữ liệu đằng sau hầu hết các trang web WordPress trực tiếp.
Vấn đề nan giải về việc sử dụng kép
Phát hiện này được đưa ra khi các công ty AI phải đối mặt với sự giám sát chặt chẽ hơn về cách các mô hình của họ có thể bị lạm dụng. Các mô hình biên giới ngày càng được đánh giá cao về khả năng hỗ trợ tấn công mạng và kết quả ngày càng trở nên khó chịu hơn khi khả năng tăng lên. Một mô hình có thể giảm chi phí tìm kiếm lỗi nghiêm trọng từ hàng trăm nghìn đô la xuống chỉ bằng vài ly cà phê, sẽ định hình lại bối cảnh mối đe dọa theo những cách cụ thể.
Những người bảo vệ lập luận rằng khả năng tương tự sẽ đẩy nhanh công việc phòng thủ, giúp các nhóm bảo mật tìm và vá các lỗ hổng trước khi những kẻ tấn công thực hiện. Bản thân Searchlight Cyber chiếm cả hai phía của ranh giới đó, cung cấp các công cụ quản lý bề mặt tấn công và giám sát web tối trong khi xuất bản các nghiên cứu tấn công. Trình kiểm tra wp2Shell thể hiện trường hợp phòng thủ: biến khám phá thành thứ gì đó mà quản trị viên có thể hành động ngay lập tức.
Nhưng sự bất đối xứng khó có thể bỏ qua. Một nhà nghiên cứu đơn độc có khóa API giờ đây có quyền truy cập vào khả năng kiểm tra mà trước đây yêu cầu một nhóm được tài trợ tốt. Khi chi phí tìm kiếm lỗ hổng giảm xuống, gánh nặng sẽ chuyển sang tốc độ và quy mô mà chúng có thể được vá.
Ý nghĩa của nó đối với WordPress và hơn thế nữa
Đối với hệ sinh thái WordPress, nghiên cứu này là một lời nhắc nhở rằng kiến trúc hấp dẫn của nền tảng, nền tảng của nền kinh tế plugin, cũng là điểm yếu nghiêm trọng nhất của nó. Các nhà điều hành trang web được khuyến khích chạy trình kiểm tra wp2Shell, luôn cập nhật các plugin và lõi, đồng thời hạn chế những gì người dùng chưa được xác thực có thể tiếp cận.
Nhìn rộng hơn, thử nghiệm này là một điểm dữ liệu trong một cuộc tranh luận đang diễn ra nhanh chóng về việc ranh giới nên nằm ở đâu giữa nghiên cứu bảo mật mở và sự phổ biến của khả năng tấn công AI. Khi các mô hình mã hóa ngày càng có nhiều khả năng hơn, những cuộc trình diễn như thế này có thể sẽ trở nên phổ biến hơn chứ không phải ít hơn.
Đi trước AI
Sự giao thoa giữa AI và an ninh mạng đang tiến triển nhanh hơn bất kỳ nhóm nào có thể theo dõi. Để báo cáo về nghiên cứu AI mang tính tấn công, các công cụ phòng thủ và các cuộc tranh luận về chính sách sau đó, hãy theo dõi tin tức về ngành AI tại AI Buzz Wire.
Đọc thêm tin tức về AI →


