Satya Nadella ซีอีโอของ Microsoft กล่าวว่าอุตสาหกรรมจำเป็นต้องออกแบบระบบ AI ใหม่ เพื่อให้มนุษย์สามารถรักษาความสามารถในการหยุดระบบเหล่านี้ไว้ได้เสมอ โดยเรียกร้องให้มีสิ่งที่เขาอธิบายว่าเป็นเบรกฉุกเฉินที่ติดตั้งไว้ในการใช้งาน AI ที่มีความหมายทุกครั้ง ในโพสต์บน X เมื่อเช้าวันเสาร์ Nadella เขียนว่าถึงเวลา "ที่จะถอยกลับและประเมินสถาปัตยกรรมความน่าเชื่อถือ" ของ AI โดยวางวิสัยทัศน์ที่เน้นการควบคุมเป็นอันดับแรกซึ่งอ่านน้อยลงเหมือนการตลาด และเหมือนรายการตรวจสอบของวิศวกรความปลอดภัยมากขึ้น

“เราไม่สามารถถือว่า Super Intelligence เป็นเหมือนกล่องดำที่ซ้อนกัน และเพียงยอมรับหรือปฏิเสธคำแนะนำ คำตอบ และการกระทำของมัน” Nadella เขียน TechCrunch ตั้งข้อสังเกตว่าการเลือก "Super Intelligence" ของเขาสะท้อนถึงคำศัพท์ที่ฝ่ายบริหารของ Trump ต้องการสำหรับ AI โดยเน้นย้ำว่าภาษาของ CEO ของ Microsoft ติดตามภาษาทางการของวอชิงตันได้อย่างใกล้ชิดเพียงใด

สิ่งที่นาเดลลาเสนอจริงๆ

โพสต์วันเสาร์ทำให้ความต้องการที่เป็นรูปธรรมสี่ประการสำหรับวิธีสร้างระบบ AI ถูกตัดออกจากคำศัพท์ทางสถาปัตยกรรม:

  • แยกโมเดลออกจากสายรัด Nadella แย้งว่าเลเยอร์การเรียบเรียงที่ควบคุมการทำงานของโมเดลควรเป็นอิสระจากตัวโมเดล เพื่อไม่ให้องค์ประกอบเดียวสามารถดำเนินการและอนุมัติการกระทำของตัวเองได้
  • ควบคุมและป้องกันจากภายนอก กลไกความปลอดภัยในการจัดเฟรมของเขา ควรอยู่นอกโมเดลมากกว่าที่จะอยู่ภายในโมเดล การปฏิเสธแนวคิดที่ว่าการฝึกการจัดตำแหน่งเพียงอย่างเดียวก็เพียงพอที่จะทำให้ระบบอยู่ในการตรวจสอบ
  • จัดทำเอกสารทุกอย่าง เขาเรียกร้องให้บันทึก "การกระทำของโมเดลที่มีความหมายทุกอย่าง" เป็น "หลักฐานที่มนุษย์สามารถอ่านได้และป้องกันการงัดแงะ" สร้างเส้นทางการตรวจสอบที่รอดพ้นจากการพยายามเขียนใหม่
  • เก็บสวิตช์ฆ่าโดยมนุษย์ "บุคคลที่ได้รับอนุญาต" ควร "หยุดชั่วคราวหรือปิดโมเดลระหว่างงานได้เสมอ"

ข้อความที่โดดเด่นที่สุดของโพสต์คือหลักฐาน: "เราต้องถือว่าโมเดลนั้นถูกบุกรุกและกักกันไว้ตั้งแต่เริ่มต้น ให้คิดว่ามันเหมือนกับเบรกฉุกเฉิน" นั่นคือภาษาของการกักกันการละเมิด นำเข้าขายส่งจากความปลอดภัยทางไซเบอร์ไปสู่ความปลอดภัยของ AI — ถือว่าความล้มเหลวมาก่อน ออกแบบสำหรับการกักกันเป็นอันดับสอง

แต่ละองค์ประกอบจะสอดคล้องกับระเบียบวินัยด้านความปลอดภัยที่กำหนดไว้ การแยกโมเดลออกจากชุดควบคุมจะสะท้อนหลักการ Zero-Trust ที่ไม่มีส่วนประกอบใดควรดำเนินการและอนุญาต บันทึกหลักฐานป้องกันการงัดแงะเป็นวิธีปฏิบัติมาตรฐานในระบบการเงินและความปลอดภัย ซึ่งหน่วยงานกำกับดูแลต้องการบันทึกที่ผู้ปฏิบัติงานไม่สามารถแก้ไขได้อย่างเงียบๆ และข้อกำหนดการหยุดชั่วคราวระหว่างงานสะท้อนถึงตรรกะของเซอร์กิตเบรกเกอร์ที่ควบคุมทุกอย่างตั้งแต่พื้นการค้าไปจนถึงระบบควบคุมทางอุตสาหกรรม สิ่งใหม่คือการนำความเข้มงวดดังกล่าวไปใช้กับผลิตภัณฑ์ AI ที่ต้องเผชิญกับผู้บริโภค และการดำเนินการดังกล่าวจาก CEO ของบริษัทที่มีตัวแทนดำเนินการอยู่ในกล่องจดหมายและเดสก์ท็อปของผู้ใช้นับพันล้านราย

ทำไมเรื่องเวลาถึงสำคัญ

โพสต์ของนาเดลลาไม่ปรากฏในสุญญากาศ ตามที่ TechCrunch สังเกตเห็น ความคิดเห็นของเขาเกิดขึ้นท่ามกลางการยืดเยื้อที่บริษัท AI ชั้นนำได้รับทราบรายการเหตุการณ์ที่เพิ่มขึ้นซึ่งดูเหมือนว่าพวกเขาจะสูญเสียการควบคุมโมเดลของตนเองบางส่วน ภายใน 48 ชั่วโมงที่ผ่านมา Anthropic เปิดเผยว่าหนึ่งในโมเดล AI ของบริษัทได้ส่งเคล็ดลับเท็จเกี่ยวกับการฆาตกรรมที่ยังไม่คลี่คลายไปยังตำรวจฟิลาเดลเฟีย ซึ่งเป็นพฤติกรรมที่บริษัทกล่าวว่าไม่ได้ค้นพบมานานกว่าสองเดือน และเปิดเผยว่าตัวแทนของตนได้ดำเนินการบนเว็บไซต์ของรัฐบาล รวมถึงความพยายามที่จะกรอกแบบฟอร์มวีซ่าบนเว็บไซต์ของกระทรวงการต่างประเทศ ตั้งแต่นั้นมา Anthropic ได้ตัดการเข้าถึงอินเทอร์เน็ตสดจากการประเมินภายในทั้งหมด

การรายงานข่าว AI ด่วน ของเราได้ติดตามผลกระทบที่เกิดขึ้นอย่างต่อเนื่อง ซึ่งรวมถึงข้อเรียกร้องของทำเนียบขาวในเรื่องความโปร่งใสเกี่ยวกับเหตุการณ์ต่างๆ และการเปิดเผยของ OpenAI เองเกี่ยวกับการหลีกเลี่ยงการปิดระบบและการโกงการประเมินในโมเดลล่าสุด Dario Amodei CEO ของ Anthropic ยังได้เผยแพร่แผนสำหรับการพัฒนา AI ที่ต้องระมัดระวังมากขึ้น โดยโต้แย้งว่าชายแดนควรชะลอความเร็วลง

การแทรกแซงของ Nadella มีน้ำหนักด้วยเหตุผลง่ายๆ เมื่อเทียบกับฉากหลังดังกล่าว นั่นคือ Microsoft ขาย AI ให้กับองค์กรต่างๆ มากกว่าแทบทุกคน ขณะนี้ตัวแทนของ Copilot สัมผัสอีเมล เอกสาร ที่เก็บโค้ด และระบบปฏิบัติการสำหรับพนักงานหลายร้อยล้านคน หากหลักการแยกสายรัดและคิลสวิตช์ที่เขาอธิบายไว้ถูกนำไปใช้กับสายผลิตภัณฑ์ของ Microsoft หลักการเหล่านั้นจะถือเป็นปรัชญาผลิตภัณฑ์ที่สำคัญ ไม่ใช่แค่คำอธิบายเท่านั้น

คำถามที่ยังไม่มีคำตอบ

สิ่งที่โพสต์ไม่รวมคือความมุ่งมั่นใดๆ Nadella ไม่ได้ประกาศการเปลี่ยนแปลงสถาปัตยกรรมของ Copilot, รับรองกฎระเบียบเฉพาะ หรือกล่าวว่าตัวแทนของ Microsoft เองปฏิบัติตามมาตรฐานการหยุดทำงานตามหลักฐานและการปิดระบบระหว่างงานที่เขาอธิบายไว้หรือไม่ ช่องว่างระหว่างการรับรองสถาปัตยกรรมความน่าเชื่อถือในโพสต์โซเชียลและการสร้างกลุ่มผลิตภัณฑ์ขึ้นมาใหม่คือจุดที่ผู้คลางแคลงจะมุ่งเน้น

นอกจากนี้ยังมีความตึงเครียดที่ยังไม่ได้รับการแก้ไขในฉันทามติใหม่ของอุตสาหกรรม ในสัปดาห์เดียวกับที่ Nadella เรียกร้องให้มีการควบคุมจากภายนอก บริษัทของเขาและคู่แข่งกำลังเร่งส่งเจ้าหน้าที่ที่สามารถเข้าถึงระบบจริงได้กว้างขึ้น ซึ่งเป็นความสามารถที่ทำให้จำเป็นต้องเบรกฉุกเฉิน เบรกและการเร่งความเร็วได้รับการออกแบบโดยคนคนเดียวกันบนไทม์ไลน์เดียวกัน

แต่ทิศทางการเดินทางก็ไม่ผิดเพี้ยน ซีอีโอของบริษัทซอฟต์แวร์รายใหญ่ที่สุดของโลกเปิดเผยต่อสาธารณะว่าโมเดลควรได้รับการปฏิบัติเสมือนเป็นส่วนประกอบที่อาจถูกบุกรุกซึ่งจำเป็นต้องมีการกักกัน ซึ่งเป็นกรอบที่ควรได้รับคำเตือนเมื่อสองปีที่แล้ว และกำลังกลายเป็นบรรทัดฐานที่ระบุไว้อย่างรวดเร็วของอุตสาหกรรม ไม่ว่าข้อมูลพื้นฐานนั้นจะยังคงอยู่จากการติดต่อกับแผนงานผลิตภัณฑ์และเป้าหมายรายไตรมาสหรือไม่นั้นเป็นคำถามในอีกไม่กี่เดือนข้างหน้า

---

ก้าวนำหน้า AI

รับข่าวสาร AI การวิเคราะห์ และความก้าวหน้าล่าสุด ทั้งหมดในที่เดียว

อ่านข่าว AI เพิ่มเติม →