Anthropic กล่าวหาว่า Alibaba ดำเนินการรณรงค์กลั่นแกล้งแบบจำลองที่ผิดกฎหมายครั้งใหญ่ที่สุดเท่าที่เคยวัดมา ซึ่งเป็นส่วนหนึ่งของการโจมตีแบบสกัดกั้นจากห้องปฏิบัติการ AI ในจีน 7 แห่งที่บริษัทกล่าวว่าตรวจพบและหยุดชะงักตั้งแต่เดือนกุมภาพันธ์ 2569 ข้อกล่าวหาดังกล่าวปรากฏในรายงานข่าวกรองภัยคุกคามของ Anthropic เดือนกันยายน 2569 ซึ่งเผยแพร่เมื่อวันพฤหัสบดี ซึ่งอุทิศส่วนทั้งหมดให้กับความพยายามในระดับอุตสาหกรรมในการโคลนความสามารถของ Claude
การเปิดเผยข้อมูลดังกล่าวถือเป็นการบัญชีสาธารณะที่มีรายละเอียดมากที่สุด ซึ่งเป็นแนวทางปฏิบัติที่กลายเป็นหนึ่งในปัญหาที่ถกเถียงกันมากที่สุดในอุตสาหกรรม AI อย่างเงียบๆ สำหรับใครก็ตามที่ติดตาม ข่าวด่วน AI รายงานดังกล่าวระบุว่าเป็นการต่อสู้ที่ดุเดือดระหว่างห้องปฏิบัติการชายแดนของสหรัฐฯ กับคู่แข่งของจีนว่าใครเป็นผู้ควบคุมโมเดลที่มีความสามารถมากที่สุด และวิธีที่ได้รับความสามารถเหล่านั้น
สิ่งที่มานุษยวิทยาบอกว่าอาลีบาบาทำ
ตามรายงาน ผู้ดำเนินการที่เป็นพันธมิตรกับ Qwen หรือ Tongyi ของอาลีบาบา Lab ได้แทรกข้อความแจ้งคงที่ลงในทุกคำขอที่บังคับให้ Claude เขียนการให้เหตุผลแบบลูกโซ่ทางความคิดทั้งหมดภายในแท็กข้อความอินไลน์ก่อนตอบ จากนั้นบันทึกการให้เหตุผลเหล่านั้นและแปลงเป็นข้อมูลการปรับแต่งแบบละเอียดภายใต้การดูแล ซึ่ง Anthropic กล่าวว่าใช้เพื่อช่วยฝึก Qwen 3.5, 3.6 และ 3.7
ขนาดที่โดดเด่น Anthropic กล่าวว่าแคมเปญนี้กำหนดเป้าหมายไปที่บันทึกห่วงโซ่ความคิดของ Opus 4.6 และ 4.7 ซึ่งมีการแลกเปลี่ยนสูงสุดเกือบ 3 ล้านการแลกเปลี่ยนต่อวันที่เปิดตัวจากบัญชีที่ฉ้อโกงมากกว่า 3,500 บัญชี และรวมการแลกเปลี่ยนที่สังเกตได้มากกว่า 151 ล้านครั้งระหว่างเดือนพฤษภาคมถึงกรกฎาคม 2569 บริษัทระบุว่าการดำเนินการดำเนินการผ่านสองกลุ่มของบัญชีฉ้อโกงเกือบ 5,000 บัญชีที่ใช้พรอกซีที่อยู่อาศัย ที่อยู่อีเมลสำรอง และการชำระเงินด้วยบัตรเสมือนเพื่อซ่อน เส้นทางของพวกเขา เมื่อ Anthropic แบนพูลแรก การรับส่งข้อมูลก็เปลี่ยนไปที่พูลที่สอง
นอกเหนือจากการกลั่นแล้ว รายงานยังอ้างว่าอาลีบาบายังใช้ Claude เพื่อพัฒนาการวิจัยและพัฒนา AI ของตนเอง รวมถึงการสร้างสภาพแวดล้อมการเรียนรู้ที่เสริมกำลัง และการวิจัยสถาปัตยกรรมแบบจำลอง Anthropic กล่าวว่าบางบัญชีพบว่าเป็นคำขอช่องทางจาก DeepSeek และ Xiaomi เช่นกัน โดยแนะนำว่าเครือข่ายพร็อกซีเดียวกันนั้นให้บริการแก่หลายองค์กร
Moonshot เสิร์ฟ Claude แทน Kimi
ข้อกล่าวหาต่อ Moonshot AI ซึ่งเป็นผู้สร้างตระกูลโมเดล Kimi อาจเป็นข้อกล่าวหาที่ผิดปกติที่สุด Anthropic รายงานว่า Moonshot ส่งต่อคำขอของลูกค้าไปยัง Claude แทนที่จะประมวลผลด้วยโมเดลของตัวเอง จากนั้นจึงแสดงคำตอบของ Claude ต่อผู้ใช้ที่เชื่อว่าพวกเขากำลังพูดคุยกับ Kimi
ในกรณีหนึ่ง Anthropic นับคำขอของลูกค้าเกือบ 300,000 คำขอที่ส่งต่อไปยัง Anthropic ภายในเวลาเพียงสิบวัน โดยส่วนใหญ่ส่งไปยัง Opus การดำเนินการดังกล่าวดำเนินการผ่านเครือข่ายพร็อกซีที่มีบัญชีหลอกลวงจำนวน 5,380 บัญชี ซึ่งส่วนใหญ่อยู่ในสิงคโปร์และญี่ปุ่น ระหว่างเดือนพฤษภาคมถึงกรกฎาคม 2026 Anthropic มีการแลกเปลี่ยนมากกว่า 23 ล้านครั้งในแคมเปญนี้
Moonshot ยังสร้างสิ่งที่ Anthropic เรียกว่าการโจมตีแบบเล่นซ้ำข้ามเซสชัน โดยบันทึก "ลายเซ็นต์แห่งการคิด" ที่เข้ารหัสไว้ที่ Claude กลับมา แทนที่จะใช้การให้เหตุผลแบบดิบ จากนั้นเริ่มเซสชันใหม่และแจ้งให้ Claude แปลงลายเซ็นนั้นกลับไปเป็นการติดตามการให้เหตุผลแบบเต็ม Anthropic กล่าวว่า DeepSeek ใช้เทคนิคเดียวกัน และมีการใช้การป้องกันแบบใหม่
รายงานระบุมิติความเป็นส่วนตัวที่ร้ายแรง: ข้อความค้นหาของผู้ใช้ที่ Moonshot เปลี่ยนเส้นทางมีข้อมูลที่ละเอียดอ่อนที่ลูกค้าไม่เคยยินยอมที่จะแบ่งปันกับบุคคลที่สาม ตัวอย่าง ได้แก่ ผู้ใช้ที่มีแนวโน้มว่าจะเกี่ยวข้องกับกองทัพปลดปล่อยประชาชนจีนที่กำลังวิเคราะห์ข้อมูลกล้องวงจรปิดของบุคคลเป้าหมายจากกล้องหลายร้อยตัวในเฉิงตู และวิศวกรของบริษัทรัฐวิสาหกิจรายใหญ่ของจีนซึ่งมีรหัสภายในและข้อมูลประจำตัวที่เผยแพร่ผ่าน Claude โดยที่เขาไม่รู้
การดำเนินการถ่ายทอดของ DeepSeek
Anthropic กล่าวว่า DeepSeek ใช้กลยุทธ์ที่คล้ายกัน โดยถ่ายทอดคำขอของผู้ใช้ไปยัง Claude Opus อย่างเงียบๆ และเก็บเกี่ยวร่องรอยการให้เหตุผลผ่านวิธีการเล่นซ้ำข้ามเซสชันแบบเดียวกัน รายงานของบริษัทระบุเป้าหมายโดยการตรวจสอบคำขอขาเข้าสำหรับสตริงที่เกี่ยวข้องกับชุดการเข้ารหัสของบุคคลที่สาม เช่น Claude Code, Claude Agent SDK และ OpenCode จากนั้นเลือกคำขอของผู้ใช้ที่ติดแท็กสำหรับการส่งต่อ
ระดับที่เกิดจาก DeepSeek: มีการแลกเปลี่ยนมากกว่า 12.1 ล้านครั้งที่พบในเวลาเพียง 14 วันในเดือนกรกฎาคม 2569 ข้อมูลที่ส่งต่อได้เปิดเผยสิ่งที่ผู้ใช้สันนิษฐานว่าเป็นข้อมูลส่วนตัว ตัวอย่างของ Anthropic ได้แก่ พนักงานของบริษัทเทคโนโลยีจีนที่กำลังวิเคราะห์เอกสารภายในสำหรับโปรแกรม AI ที่เป็นเรือธง ผู้ปฏิบัติงานด้านไอทีที่ทำงานกับข้อมูลจากหน่วยงานรัฐบาลรัสเซียที่เกี่ยวข้องกับกระทรวงกลาโหม ซึ่งคำขอดังกล่าวได้เปิดเผยข้อมูลรับรองฐานข้อมูลสด และวิศวกรที่สำนักงานความมั่นคงสาธารณะประจำเทศบาลในประเทศจีน ได้สร้างเครื่องมือที่ติดตามความเคลื่อนไหวของบุคคลต่อบันทึกของตำรวจด้วยหมายเลขประจำตัวประชาชน
Zipu, Xiaomi และรูปแบบที่กว้างขึ้น
รายงานยังระบุถึงแคมเปญการดึงความคิดแบบลูกโซ่มาจาก Zhipu AI ซึ่งตั้งชื่อแบรนด์ตัวเองว่า Z.ai นอกประเทศจีน Anthropic กล่าวว่า Zhipu ดำเนินการไปป์ไลน์กับ Opus 4.8 โดยหมุนเวียนบัญชีที่ฉ้อโกง 273 บัญชีในช่วงสิบวันในเดือนมิถุนายน โดยนับการแลกเปลี่ยน 770,609 รายการผ่านตัวล้าง CoT-extraction และการแลกเปลี่ยนทั้งหมดมากกว่า 3 ล้านครั้งในช่วงเวลาเดียวกัน
DeepSeek, Xiaomi และ Moonshot ถูกกล่าวหาแยกกันในการป้อนการสนทนาระหว่างผู้ใช้และโมเดลของตนเองลงใน Claude เพื่อเป็นข้อมูลการฝึกอบรม Anthropic กล่าวว่าเซสชันเหล่านั้นประกอบด้วยชื่อ ที่อยู่อีเมล ข้อมูลบริษัท และข้อมูลที่ละเอียดอ่อนอื่นๆ จากผู้ใช้ปลายทางหลายร้อยรายในภาษาต่างๆ อย่างน้อย 12 ภาษา ซึ่งส่วนใหญ่ถ่ายทอดผ่านบริการกำหนดเส้นทางโมเดลบุคคลที่สามซึ่งได้รับความนิยมจากผู้ใช้ในสหรัฐอเมริกาและยุโรป และแนวทางปฏิบัติดังกล่าวอาจไม่สอดคล้องกับกฎหมายความเป็นส่วนตัวและข้อกำหนดในการให้บริการของห้องปฏิบัติการเอง
เหตุใดการกลั่นจึงหยุดได้ยาก
การกลั่นเป็นวิธีการฝึกอบรมที่ถูกต้องตามกฎหมายและใช้กันอย่างแพร่หลาย: โมเดล "นักเรียน" ขนาดเล็กเรียนรู้จากผลงานของโมเดล "ครู" ที่ใหญ่กว่า สิ่งที่ Anthropic นิยามว่าผิดกฎหมายคือเวอร์ชันแอบแฝงในระดับอุตสาหกรรม บัญชีปลอมที่สร้างขึ้นจากบัตรเครดิต ข้อมูลประจำตัว และคีย์ API ที่ถูกขโมย รวมถึงใบรับรองผลการเรียนผู้ใช้ที่ซื้อจากบริการพร็อกซีที่บันทึกการสนทนาโดยที่ผู้ใช้ไม่รู้ตัว
ความพยายามในการดึงข้อมูลที่บันทึกไว้ในรายงานมีตั้งแต่แบบตรงไปตรงมาไปจนถึงแบบสร้างสรรค์ ห้องปฏิบัติการแห่งหนึ่งทำการทดลอง 12,000 คำขอ โดยแต่ละคำขอใช้เทคนิคที่แตกต่างกัน เพื่อค้นหาว่าคำขอใดจะดึงเหตุผลของโคลดออกมาได้ อีกคนหนึ่งสั่งให้โมเดล "แปล" หน่วยความจำการทำงานก่อนหน้านี้เป็นภาษาญี่ปุ่นแบบคาตาคานะเท่านั้น เพื่อเลี่ยงตัวกรองป้องกันการกลั่น
OpenAI ได้ตั้งค่าสถานะการโจมตีด้วยการกลั่นอย่างเปิดเผยต่อสาธารณะตั้งแต่ต้นปี 2568 และ Google ได้เผยแพร่ตัวติดตามภัยคุกคามเกี่ยวกับการกลั่นแบบฝ่ายตรงข้ามเมื่อต้นปีนี้ การมีส่วนร่วมของมานุษยวิทยานั้นมีขนาดและความจำเพาะ: ห้องแล็บที่มีชื่อ โมเดลที่มีชื่อ และตัวเลขที่ชัดเจน
Anthropic กล่าวว่าการโจมตีของห้องปฏิบัติการทั้ง 7 แห่งมุ่งเป้าไปที่โมเดลที่มีอยู่ทั่วไป และไม่พบความพยายามใด ๆ ต่อระบบ Mythos 5 หรือ Mythos Preview ที่ถูกจำกัด ซึ่งไม่สามารถเข้าถึงได้โดยสาธารณะ นอกจากนี้ยังตั้งข้อสังเกตอีกว่าแบบจำลองที่กลั่นจากระบบชายแดนไม่ได้รับราวกั้นความปลอดภัย และการวิจัยของตัวเองชี้ให้เห็นว่าการกลั่นสามารถยกระดับความสามารถที่เป็นอันตรายในโดเมนทางชีววิทยาและไซเบอร์ได้ แม้ว่าการแลกเปลี่ยนที่เก็บเกี่ยวจะมีเนื้อหาเกี่ยวกับหัวข้อเหล่านั้นเพียงเล็กน้อยก็ตาม
บริษัทกล่าวว่าทุกแคมเปญที่อธิบายไว้ถูกหยุดชะงัก มาตรการป้องกันได้รับการเสริมสร้างให้เข้มแข็งขึ้นในการตอบสนอง และข่าวกรองดังกล่าวได้รับการแบ่งปันกับหน่วยงานและพันธมิตรในอุตสาหกรรมตามความเหมาะสม ไม่ว่าการตั้งชื่อจะเปลี่ยนแปลงเศรษฐศาสตร์ของการโคลนนิ่งโมเดลชายแดน หรือเพียงบันทึกการแข่งขันทางอาวุธที่ดำเนินไปอย่างเต็มกำลังแล้ว จะขึ้นอยู่กับว่าจะเกิดอะไรขึ้นต่อไป
---
ก้าวนำหน้า AIรับข่าวสาร AI การวิเคราะห์ และความก้าวหน้าล่าสุด ทั้งหมดในที่เดียว
อ่านข่าว AI เพิ่มเติม →