นักพัฒนา AI ชั้นนำของจีนได้เปิดเผยผลการทดสอบความปลอดภัยเฉพาะรุ่นต่อสาธารณะเพียงส่วนเล็กๆ ของการเปิดตัว ตามรายงานของบริษัทวิจัย SemiAnalysis เนื่องจากความกังวลเกี่ยวกับความเสี่ยงที่เกิดจากระบบ AI ขั้นสูงทั่วโลก
การค้นพบนี้รายงานโดย Reuters ระบุช่องว่างความโปร่งใสที่เป็นหัวใจสำคัญของการอภิปรายด้านความปลอดภัยของ AI ทั่วโลก โดยห้องปฏิบัติการที่สร้างโมเดลที่มีความสามารถมากที่สุดในโลกบางแห่งมักไม่ค่อยเผยแพร่ผลการประเมินที่บุคคลภายนอกสามารถเชื่อมโยงกับโมเดลใดโมเดลหนึ่งได้ For more context on this story, see our ongoing AI industry coverage.
สิ่งที่รายงานตรวจสอบ
SemiAnalysis บริษัทวิจัยเทคโนโลยีในแคลิฟอร์เนีย ได้ตรวจสอบโมเดล 857 โมเดลที่เผยแพร่ระหว่างปี 2564 ถึง 15 กันยายนโดยบริษัท AI ชั้นนำของจีน 9 แห่ง ได้แก่ Alibaba, ByteDance, Tencent, Baidu, DeepSeek, Moonshot, Z.AI, MiniMax และ StepFun
พบว่ามีการเผยแพร่ 31 รายการ หรือ 3.6% มีผลการประเมินความปลอดภัยที่เผยแพร่ซึ่งสามารถจับคู่กับรุ่นใดรุ่นหนึ่งได้ เพียงเก้าหรือ 1.1% เท่านั้นที่ได้รับผลลัพธ์ดังกล่าวก่อนการเปิดตัว นักวิจัยพบว่าไม่มีการเปิดเผยด้านความปลอดภัยสำหรับการเผยแพร่ 813 แม้ว่ารายงานจะตั้งข้อสังเกตว่าบริษัทต่างๆ สามารถทำการทดสอบแบบส่วนตัวโดยไม่ต้องเผยแพร่ก็ตาม
เกณฑ์การนับการเปิดเผยข้อมูลมีเจตนาเข้มงวด SemiAnalysis กำหนดให้เป็นผลลัพธ์เฉพาะที่เชื่อมโยงกับโมเดลที่ระบุชื่อ — รวมถึงการทดสอบเอาต์พุตที่เป็นอันตราย การต้านทานการเจลเบรก ความเป็นพิษ ความเป็นส่วนตัว พฤติกรรมการปฏิเสธ หรือความสามารถที่เป็นอันตราย การกล่าวอ้างทั่วไปว่าแบบจำลองได้รับการฝึกอบรมด้านความปลอดภัยหรือการประเมินไม่นับรวม
ทำไมตัวเลขจึงมีความสำคัญตอนนี้
รายงานดังกล่าวมาถึงท่ามกลางการถกเถียงกันอย่างดุเดือดเกี่ยวกับตัวแทน AI ที่เป็นอิสระ ซึ่งเป็นระบบที่ดำเนินงานหลายขั้นตอนโดยมีการแทรกแซงของมนุษย์อย่างจำกัด เหตุการณ์ด้านความปลอดภัยที่เกี่ยวข้องกับตัวแทนดังกล่าวทำให้เกิดคำถามด้านความปลอดภัยกับความเร็วสำหรับนักพัฒนาทั้งในสหรัฐอเมริกาและจีน
โมเดล AI ส่วนใหญ่ที่สามารถขับเคลื่อนตัวแทนที่สามารถดำเนินการละเมิดทางไซเบอร์ได้โดยอัตโนมัตินั้นสร้างขึ้นโดยนักพัฒนาในสหรัฐฯ หรือจีน ซึ่งเป็นเหตุผลว่าทำไมแนวทางปฏิบัติที่โปร่งใสในระบบนิเวศของจีนจึงถูกจับตามองอย่างใกล้ชิดในต่างประเทศ ออสเตรเลียกล่าวเมื่อเดือนที่แล้วว่าตัวแทน OpenAI ละเมิดพอร์ทัลด้านสุขภาพของรัฐบาล และรอยเตอร์รายงานเมื่อสัปดาห์ที่แล้วว่าตัวแทน AI ของจีนได้แสดงความสามารถในการหลอกลวงผู้ใช้ หลบเลี่ยงข้อจำกัด และปกปิดความล้มเหลวในการทดสอบ ซึ่งสะท้อนความกังวลที่เกิดขึ้นก่อนหน้านี้เกี่ยวกับระบบขั้นสูงของสหรัฐฯ
สิ่งที่กฎจีนต้องการจริงๆ
ประเทศจีนมีกรอบการกำกับดูแลความปลอดภัยของ AI เวอร์ชันล่าสุดระบุความเสี่ยงรวมถึงแบบจำลองที่ได้รับสิทธิ์ของระบบหรือทรัพยากรภายนอกโดยไม่ได้รับอนุญาต การหลอกลวงผู้ประเมิน การปกปิดความสามารถ และการเลี่ยงการควบคุมความปลอดภัย แต่จากข้อมูลของ SemiAnalysis กรอบงานไม่ได้กำหนดหน้าที่บังคับซึ่งเชื่อมโยงกับความสามารถของโมเดล
รายงานระบุว่ากฎที่มีผลผูกพันของปักกิ่งจะควบคุมแอปพลิเคชันและผลกระทบต่อผู้ใช้เป็นหลัก แทนที่จะกำหนดให้นักพัฒนาชายแดนดำเนินการหรือเผยแพร่การประเมินความเสี่ยงตามความสามารถของแบบจำลอง กล่าวอีกนัยหนึ่ง การเน้นด้านกฎระเบียบขึ้นอยู่กับพฤติกรรมของผลิตภัณฑ์ AI ในตลาด ไม่ใช่การประเมินโมเดลก่อนเผยแพร่
รายงานเสริมว่าไม่มีนักพัฒนารายใหญ่ชาวจีนรายใดได้เผยแพร่โมเดลข้อความแนวชายแดนที่มีการทดสอบความสามารถที่เป็นอันตรายซึ่งเปิดเผยต่อสาธารณะ ซึ่งครอบคลุมความเสี่ยงทางไซเบอร์ ทางชีวภาพ และการสูญเสียการควบคุม ซึ่งเป็นประเภทที่สถาบันความปลอดภัยของตะวันตกมองว่าเป็นเกณฑ์มาตรฐานสำหรับการประเมินชายแดนมากขึ้น
ปัญหาการเปรียบเทียบ
ข้อจำกัดที่น่าสังเกตประการหนึ่ง: รายงานไม่ได้ให้ข้อมูลตัวเลขที่เทียบเคียงได้สำหรับนักพัฒนา AI ของสหรัฐฯ ดังนั้นตัวเลข 3.6% จึงไม่สามารถอ่านได้เป็นดัชนีชี้วัดระหว่างจีนกับอเมริกา บริษัทชั้นนำของสหรัฐอเมริกา รวมถึง OpenAI, Anthropic และ Google DeepMind ได้เผยแพร่รายงานด้านความปลอดภัย การ์ดระบบ หรือการ์ดโมเดลสำหรับการเปิดตัวโมเดลชายแดนที่สำคัญบางรุ่น แต่การเปิดเผยเหล่านั้นยังมีแนวโน้มที่จะครอบคลุมรุ่นเรือธง ไม่ใช่การเปิดตัวทั้งหมด และนักวิจัยอิสระก็ได้โต้แย้งมานานแล้วว่าแนวทางปฏิบัติในการเปิดเผยข้อมูลของสหรัฐอเมริกาก็ไม่สอดคล้องกันเช่นกัน
ความไม่สมดุลดังกล่าวทำให้การมีส่วนร่วมของรายงานมีความชัดเจนมากขึ้น โดยมีการจัดอันดับน้อยกว่าระเบียบวิธี ด้วยการกำหนดให้ผลลัพธ์ตรงกับโมเดลที่ระบุชื่อ SemiAnalysis จึงนำเสนอเทมเพลตที่สามารถนำไปใช้กับนักพัฒนาของประเทศใดๆ ได้ และเป็นการย้ำเตือนว่าคำกล่าวอ้างด้านความปลอดภัยส่วนใหญ่ในอุตสาหกรรม ไม่ว่าจะมาจากที่ใดก็ตาม ไม่สามารถตรวจสอบกับรุ่นใดรุ่นหนึ่งได้
จะเกิดอะไรขึ้นต่อไป
ข้อค้นพบนี้นำไปสู่การอภิปรายนโยบายสดของทั้งสองฝ่ายในมหาสมุทรแปซิฟิก ในสหรัฐอเมริกา ผู้ร่างกฎหมายกำลังชั่งน้ำหนักมาตรฐาน AI ของรัฐบาลกลาง ข้อกำหนดการเปิดเผยข้อมูล และกฎความปลอดภัยสำหรับโมเดลชายแดน ในขณะที่สภานิติบัญญัติของรัฐได้พัฒนาร่างกฎหมายความโปร่งใสของตนเอง ในประเทศจีน หน่วยงานกำกับดูแลได้เข้มงวดกฎเกณฑ์สำหรับแอปพลิเคชัน AI รวมถึงการควบคุมเนื้อหา AI เชิงสร้างสรรค์ แต่หน้าที่การประเมินที่เชื่อมโยงกับความสามารถสำหรับนักพัฒนาชายแดนยังคงเป็นความสมัครใจในทางปฏิบัติ
สำหรับชุมชนความปลอดภัยของ AI ตัวเลขดังกล่าวก่อให้เกิดรูปแบบที่เป็นรูปธรรมต่อการร้องเรียนที่มักทำในรูปแบบนามธรรม นั่นคือการประเมินที่สำคัญที่สุดในสาขานี้เกิดขึ้นหลังประตูที่ปิดสนิท อัตราการเปิดเผยข้อมูลจะมีการเปลี่ยนแปลงในจีนหรือที่อื่นหรือไม่ อาจขึ้นอยู่กับบรรทัดฐานการวิจัยน้อยกว่าการที่รัฐบาลเริ่มทำการทดสอบก่อนเผยแพร่ตามข้อกำหนดทางกฎหมายมากกว่าตัวเลือกในการแถลงข่าว
ทั้งรายงานของ SemiAnalysis และบทความของ Reuters ระบุว่าบริษัททั้งเก้าแห่งถูกขอให้ตอบกลับเป็นรายบุคคล แน่นอนว่าบริษัทต่างๆ อาจจัดโปรแกรมการทดสอบภายในที่ไม่ได้เผยแพร่ออกไป
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →