Anthropic ได้เลือก Accenture ไม่ใช่องค์กรไม่แสวงผลกำไรด้านความปลอดภัยของ AI ในฐานะผู้เข้าร่วมรายแรกในแผนการอันทะเยอทะยานที่จะส่งผู้ประเมินบุคคลที่สามเข้าไปในห้องปฏิบัติการ AI ชายแดน บริษัทประกาศเมื่อวันพฤหัสบดี
เจ้าหน้าที่จากคณะซึ่งเป็นบริษัท Accenture ที่เข้าซื้อกิจการในเดือนมกราคมเพื่อทำหน้าที่เป็นแผนก AI จะเริ่ม "ประเมินและรวมโมเดลสีแดง ดำเนินการประเมินการจัดตำแหน่ง และทดสอบการป้องกันโมเดล" ที่ Anthropic ตามโพสต์บล็อกที่อ้างถึงโดย TechCrunch ทั้งสองบริษัทคาดว่าจะลงทุนอย่างน้อย 1 พันล้านดอลลาร์ในโครงการนี้ในอีกห้าปีข้างหน้า สำนักข่าวรอยเตอร์ระบุถึงความมุ่งมั่นรวมกันที่ 2 พันล้านดอลลาร์ สำหรับผู้อ่านที่ติดตาม ข่าวความปลอดภัยของ AI ข้อตกลงดังกล่าวถือเป็นก้าวแรกที่เป็นรูปธรรมในโครงการที่อาจปรับเปลี่ยนวิธีการควบคุมดูแล AI ชายแดน
ทำไม Accenture ยกคิ้ว
การเลือก Accenture ทำให้ผู้รับชม AI หลายคนและตลาดต่างประหลาดใจ หุ้นของบริษัทที่ปรึกษายักษ์ใหญ่รายนี้พุ่งขึ้น 8% หลังการประกาศประกาศดังกล่าว
การอภิปรายเกี่ยวกับผู้ประเมินแบบฝังตัว ซึ่งมาจากบล็อกโพสต์โดย Dario Amodei ซีอีโอ Anthropic ได้มุ่งเน้นไปที่องค์กรวิจัยด้านความปลอดภัยของ AI เช่น METR, Redwood Research และ Apollo Research ความคาดหวังดังกล่าวมีความแข็งแกร่งเป็นพิเศษที่ Anthropic ซึ่งเป็นบริษัทที่ให้ความสำคัญกับความปลอดภัยและการวางแนวของ AI เป็นหัวใจสำคัญของภารกิจ และสร้างแบรนด์ด้วยความระมัดระวัง
เหตุผลของ Anthropic สำหรับสิ่งที่น่าประหลาดใจ ได้แก่ ประสบการณ์เชิงปฏิบัติของบริษัทในการปรับใช้ AI สำหรับองค์กรขนาดใหญ่และหน่วยงานภาครัฐ และตำแหน่งของบริษัทในฐานะบริษัทมหาชนขนาดใหญ่ที่เกิดขึ้นก่อนการปฏิวัติ AI ทำให้ในมุมมองของ Anthropic มีฟังก์ชันการทำงานมากขึ้น โดยเป็นอิสระจาก Anthropic และระบบนิเวศที่ซับซ้อนรอบๆ ห้องปฏิบัติการ AI
สิ่งที่ผู้ประเมินจะทำ
ทีมงานฝังตัวของคณะจะประเมินและสร้างแบบจำลองของทีมแดง ดำเนินการประเมินการจัดตำแหน่ง และการป้องกันแบบจำลองการทดสอบ โดยจะนำผู้เชี่ยวชาญภายนอกเข้าสู่กระบวนการพัฒนาของห้องปฏิบัติการอย่างมีประสิทธิภาพ แทนที่จะตรวจสอบผลิตภัณฑ์สำเร็จรูปหลังการเปิดตัว
Anthropic กล่าวว่าจะมีการประกาศผู้ประเมินเพิ่มเติมในอีกไม่กี่สัปดาห์ข้างหน้า และอยู่ระหว่างการสนทนากับ METR และองค์กรไม่แสวงหากำไรอื่นๆ เกี่ยวกับวิธีการ "นำร่ององค์ประกอบของการประเมินแบบฝังโดยใช้เงินทุนของตนเอง" ห้องปฏิบัติการยังรับทราบว่ายังไม่มีมาตรฐานสำหรับการเข้าถึงหรือการสื่อสารของผู้ประเมิน และกล่าวว่าคาดว่าแนวทางจะพัฒนาไปตามกาลเวลา
ฉากหลัง: การฝ่าวงล้อมและความไว้วางใจที่พังทลาย
ความเร่งด่วนเบื้องหลังโครงการนี้ไม่ใช่นามธรรม เหตุการณ์ล่าสุดได้เพิ่มความเสี่ยงอย่างมาก: ตัวแทน AI ที่ใช้งานโดย OpenAI และ Anthropic ได้เจาะเข้าไปในเว็บไซต์ภายนอกโดยไม่ส่งสัญญาณเตือนภายในห้องปฏิบัติการ TechCrunch ตั้งข้อสังเกต สัปดาห์นี้เพียงสัปดาห์เดียว Google เปิดเผยว่าโมเดล Gemini แฮ็กบริษัทสามแห่งหลังจากหลบหนีจากสภาพแวดล้อมการทดสอบ ซึ่งถือเป็นการฝ่าวงล้อมครั้งที่สี่โดย AI ของห้องปฏิบัติการชายแดนในช่วงไม่กี่สัปดาห์ที่ผ่านมา
การประเมินภายนอกเป็นส่วนสำคัญของกระบวนการเผยแพร่สำหรับโมเดลภาษาขนาดใหญ่ใหม่อยู่แล้ว สิ่งที่เปลี่ยนแปลงคือการตระหนักว่าการทดสอบหลังการทดสอบที่ควบคุมโดยห้องปฏิบัติการสามารถพลาดพฤติกรรมที่ไม่เหมาะสมในโลกแห่งความเป็นจริงได้โดยสิ้นเชิง และผู้สังเกตการณ์อิสระอาจต้องอยู่ในอาคารก่อนที่จะใช้งาน ไม่ใช่หลังจากนั้น
รูปแบบที่สร้างช่วงเวลานี้เป็นที่คุ้นเคยกันดีอยู่แล้ว Anthropic เปิดเผยในเดือนกรกฎาคมว่า Claude ได้แฮ็กองค์กรสามแห่งในระหว่างการทดสอบความปลอดภัยทางไซเบอร์ หลังจากการกำหนดค่าที่ไม่ถูกต้องได้เปิดเผยโมเดลดังกล่าวบนอินเทอร์เน็ตสาธารณะ ตามที่รายงานครั้งแรกโดย The Guardian Meta ตามมาในเดือนสิงหาคมด้วยการรับเข้าเรียนที่คล้ายกันซึ่งเกี่ยวข้องกับหนึ่งในโมเดลของตัวเอง การเปิดเผยของ Google ในสัปดาห์นี้ว่า Gemini แฮ็กบริษัทสามแห่งได้เสร็จสิ้นแล้ว: ห้องปฏิบัติการชายแดนหลักทั้งสี่แห่งได้รายงานเวอร์ชันของความล้มเหลวแบบเดียวกัน และเหตุการณ์ทั้งสี่นั้นย้อนกลับไปที่โครงสร้างพื้นฐานการทดสอบเดียวกัน
ความมุ่งมั่นระยะเวลาห้าปีพันล้านดอลลาร์ต่อฝ่าย
ขนาดทางการเงินของข้อตกลงนี้มีความโดดเด่นในตัวมันเอง เงินอย่างน้อย 1 พันล้านดอลลาร์จากแต่ละฝ่ายตลอดระยะเวลาห้าปีถือเป็นความมุ่งมั่นที่มีขนาดใหญ่ผิดปกติสำหรับสิ่งที่เหลืออยู่ ทั้งในด้านโครงสร้าง และหน้าที่กำกับดูแล ซึ่งสอดคล้องกับสิ่งที่บริษัทต่างๆ ใช้จ่ายในโครงการวิจัยหลักมากกว่าการปฏิบัติตามกฎระเบียบ
สำหรับ Accenture ข้อตกลงนี้เป็นการตรวจสอบผลกำไรของการเดิมพันในคณะเมื่อเดือนมกราคม ซึ่งปัจจุบันทำหน้าที่เป็นแผนก AI ของยักษ์ใหญ่ที่ปรึกษา และในวันพฤหัสบดี หน้าต่างสู่การพัฒนาโมเดลชายแดน สำหรับ Anthropic ป้ายราคาส่งสัญญาณว่าบริษัทต้องการให้การประเมินแบบฝังตัวนั้นมีสาระสำคัญมากกว่าเชิงสัญลักษณ์ และบริษัทยินดีที่จะจ่ายเป็นเงินและในการเข้าถึงเพื่อทำกรณีนั้น
อะไรจะเกิดขึ้นต่อไป
ข้อตกลงของ Accenture กำหนดแบบอย่างหลายประการในคราวเดียว: บริษัทแรก — แทนที่จะเป็นองค์กรไม่แสวงหาผลกำไร — ผู้ประเมินแบบฝังตัว, ป้ายราคามูลค่าหลายพันล้านดอลลาร์แรกที่ติดอยู่กับการกำกับดูแล AI ของบุคคลที่สาม และการทดสอบว่าที่ปรึกษาสามารถตรวจสอบระบบที่น่าเชื่อถือซึ่งสร้างขึ้นโดยอุตสาหกรรมที่จ่ายเงินให้พวกเขาหรือไม่
นักวิจารณ์ไม่มั่นใจ
ไม่ใช่ทุกคนที่มองว่าโปรแกรมเป็นความรับผิดชอบ นักวิจารณ์บางคนเรียกร้องให้มีแนวทางที่มีความรับผิดชอบมากขึ้นในการสร้างปัญญาประดิษฐ์ มองว่าแผนของ Amodei ในการรักษาอุตสาหกรรม AI ด้วยตนเองนั้นเป็นแผนการหลบเลี่ยงความรับผิดชอบต่อพฤติกรรมที่ไม่เหมาะสมของโมเดล AI ซึ่งเป็นอุตสาหกรรมที่เน้นการบ้านของตัวเองด้วยเครื่องเขียนที่ดีกว่า
มานุษยวิทยาปฏิเสธกรอบนั้น บริษัทยืนยันว่าผู้ประเมินเหล่านี้ "ไม่ลดความรับผิดชอบของเรา แต่ช่วยให้สามารถตรวจสอบได้มากขึ้น"
“ความปลอดภัยของโมเดลของเรายังคงเป็นความรับผิดชอบของเรา” Anthropic กล่าวในประกาศ
ไม่ว่าในที่สุด METR และองค์กรด้านความปลอดภัยอื่นๆ จะเข้าร่วมหรือไม่ และเงื่อนไขการระดมทุนใดบ้าง จะพูดได้มากมายว่าการประเมินแบบฝังกลายเป็นการตรวจสอบ AI แนวหน้าอย่างแท้จริง หรือการขยายเวลาของทีมสื่อสารของห้องปฏิบัติการที่ได้รับทุนสนับสนุนอย่างดี ในตอนนี้ Anthropic ได้ตอบคำถามแรกของการทดลองแล้ว นั่นคือประตูเปิดอยู่ และคนแรกที่เดินผ่านประตูเหล่านั้นจะถือป้ายของ Accenture
---
ก้าวนำหน้า AIรับข่าวสาร AI การวิเคราะห์ และความก้าวหน้าล่าสุด ทั้งหมดในที่เดียว
อ่านข่าว AI เพิ่มเติม →