Google DeepMind ได้เปิดตัวสถาบันใหม่ที่อุทิศตนเพื่อขยายการสนทนาเกี่ยวกับปัญญาประดิษฐ์ทั่วไป — และบทความเกี่ยวกับการสถาปนาประกอบด้วยข้อเสนอที่เป็นรูปธรรมจาก Demis Hassabis สำหรับองค์กรที่นำโดยสหรัฐฯ ซึ่งจะประเมินโมเดล AI ชายแดนก่อนที่จะใช้งาน
สถาบัน DeepMind ซึ่งเปิดตัวเมื่อวันพุธโดย Google และนักวิจัย DeepMind ของ Google ระบุ Shane Legg ผู้ร่วมก่อตั้ง DeepMind เป็นบรรณาธิการบริหาร ร่วมกับ James Manyika ผู้บริหารของ Google และ Demis Hassabi ประธาน Google DeepMind เป็นกรรมการ ตาม TechCrunch For more context on this story, see our ongoing AI trends.
ห้องที่ไม่เห็นด้วย
วัตถุประสงค์ที่ระบุไว้ของสถาบันคือเพื่อแสดงความขัดแย้งอย่างแท้จริง รวมถึงภายใน Google เองด้วย “พวกเขาจะไม่เห็นด้วยเสมอไป และพวกเขามีแนวโน้มที่จะเปลี่ยนใจ เมื่อมีข้อมูลและสารสนเทศเพิ่มมากขึ้นในพื้นที่ชายแดนที่เปลี่ยนแปลงอย่างรวดเร็ว” คำประกาศดังกล่าวระบุ
คอลเลกชันแรกประกอบด้วยบทความสี่บทความที่ครอบคลุมนโยบายทางเศรษฐกิจสำหรับการจัดการการหยุดชะงักของ AGI ที่อาจเกิดขึ้น การรักษาการให้เหตุผลของแบบจำลองที่มนุษย์อ่านได้ หลักการเพื่อความเจริญรุ่งเรืองของมนุษย์ และกรอบการทำงานสำหรับการประเมินแบบจำลอง AI ระดับแนวหน้า
การนำข้อขัดแย้งแบบเปิดเผยมาสู่สถาบันถือเป็นการเคลื่อนไหวที่ผิดปกติสำหรับห้องปฏิบัติการ AI ขององค์กร ซึ่งการส่งข้อความสาธารณะมีแนวโน้มที่จะได้รับการควบคุมอย่างเข้มงวด จากการออกแบบ สถาบันทำให้นักวิจัยของ Google มีสถานที่ในการโต้แย้งจุดยืนที่อาจขัดแย้งกับผลประโยชน์ทางการค้าของบริษัท หรือขัดแย้งกับผลประโยชน์ของกันและกัน
เรียงความความโปร่งใส: ดู 'ความลึกของอนุกรมทึบแสง'
หนึ่งในสี่บทความโดยนักวิจัยด้านความปลอดภัยของ DeepMind Rohin Shah และ Anca Dragan ระบุว่าหน้าต่างแห่งความโปร่งใสที่ลดลงของ AI — ความสามารถในการดูและตรวจสอบการให้เหตุผลทีละขั้นตอนของแบบจำลอง — ไม่ใช่สิ่งที่หลีกเลี่ยงไม่ได้ แม้ว่าสถาปัตยกรรมใหม่จะทำให้โมเดลที่ทรงพลังที่สุดยากต่อการตรวจสอบก็ตาม
ผู้เขียนกล่าวว่านักพัฒนาและหน่วยงานกำกับดูแลควรเผชิญหน้ากับการแลกเปลี่ยนด้านความปลอดภัยโดยตรง โดยเป็นรูปธรรม นั่นอาจหมายถึงการจำกัดสิ่งที่พวกเขาเรียกว่า "ความลึกอนุกรมแบบทึบ" - จำนวนการคำนวณตามลำดับที่แบบจำลองสามารถทำได้โดยไม่ต้องสร้างเหตุผลที่สามารถอ่านได้ - หรือกำหนดให้นักพัฒนาต้องแสดงให้เห็นว่าระบบที่โปร่งใสน้อยกว่านั้นยังคงสามารถตรวจสอบได้เท่ากับระบบที่ตีความได้
ข้อเสนอนี้มีความโดดเด่นเนื่องจากถือว่าการสูญเสียความสามารถในการตีความเป็นตัวเลือกการออกแบบและนโยบายมากกว่าผลที่ตามมาที่หลีกเลี่ยงไม่ได้ของขนาด ซึ่งเป็นการเปิดประตูสู่ข้อกำหนดที่สามารถเขียนลงในกฎระเบียบได้
ข้อเสนอของ Hassabis: หน่วยมาตรฐานชายแดนของสหรัฐฯ
เรียงความที่เป็นผลสืบเนื่องมากที่สุดอาจเป็นของฮัสซาบิส เขาเสนอหน่วยงานมาตรฐาน AI แนวชายแดนที่นำโดยสหรัฐฯ ซึ่งมอบหมายให้ประเมินโมเดล AI ที่ทันสมัยที่สุด ภายใต้กรอบนี้ นักพัฒนาซอฟต์แวร์จะส่งโมเดลด้วยความสมัครใจเพื่อรับการตรวจสอบภายใน 30 วันก่อนวางจำหน่าย เมื่อระบบการประเมินได้รับการพิสูจน์แล้วว่ามีประสิทธิผล การผ่านการทดสอบอาจกลายเป็นข้อกำหนดสำหรับการปรับใช้โมเดลชายแดนในสหรัฐอเมริกา
หน่วยงานจะเริ่มต้นด้วยการออกแบบการประเมินโดยปรึกษากับบริษัท AI แต่ในที่สุดจะพัฒนาการประเมินที่เป็นอิสระและไม่เปิดเผย ซึ่งบทความเรียกว่าการทดสอบแบบ "ระงับ" เพื่อป้องกันไม่ให้ห้องปฏิบัติการปรับแต่งแบบจำลองของตนให้ตรงกับเกณฑ์มาตรฐานที่ทราบ ซึ่งเป็นรูปแบบความล้มเหลวที่ได้รับการบันทึกไว้อย่างดีของระบบการประเมินสาธารณะ
Hassabis ยังเปิดประตูสู่การยกระดับ: กรอบงานสามารถ "เพิ่มขึ้นได้หากสถานการณ์ต้องการความร้ายแรง" อาจรวมถึงการชะลอตัวของการประสานงานระหว่างนักพัฒนา AI ชายแดน
เหตุใดอีกสองบทความจึงมีความสำคัญ
บทความอีกสองบทความที่เหลือ - เกี่ยวกับนโยบายทางเศรษฐกิจสำหรับการจัดการการหยุดชะงักของ AGI และหลักการเพื่อความเจริญรุ่งเรืองของมนุษย์ - สรุปคอลเลกชันที่ถือว่า AGI เป็นปัญหาทั่วทั้งสังคมมากกว่าปัญหาทางเทคนิคล้วนๆ การพลัดถิ่นทางเศรษฐกิจเป็นปัญหาสาธารณะที่จับต้องได้มากที่สุดเกี่ยวกับ AI ขั้นสูง และการวางกรอบไว้ควบคู่ไปกับนโยบายการประเมินและการตีความได้ แนะนำว่าสถาบันต้องการให้ผู้กำหนดนโยบายมองว่าแต่ละส่วนเป็นวาระเดียว แทนที่จะแยกการอภิปราย
ความกว้างดังกล่าวยังเป็นสัญญาณเกี่ยวกับตำแหน่งของ Google อีกด้วย บริษัทกำลังแข่งขันเพื่อแย่งชิงลูกค้าองค์กรและสัญญาภาครัฐ ในขณะเดียวกันก็โต้แย้งว่าระบบชายแดนจำเป็นต้องมีการตรวจสอบจากภายนอก การเผยแพร่ความตึงเครียด แทนที่จะทำให้คลายลง คือประเด็นหลักของสถาบัน
จากความกังวลไปสู่ข้อเสนอที่เป็นรูปธรรม
บทความดังกล่าวมาถึงในขณะที่การอภิปรายด้านความปลอดภัยของอุตสาหกรรมเปลี่ยนจากข้อความแสดงข้อกังวลอย่างกว้างๆ ไปสู่กลไกเฉพาะ เช่น ข้อกำหนดในการเปิดเผยข้อมูล การตรวจสอบจากภายนอก และการชะลอตัวที่ประสานงานกัน หากการป้องกันล้มเหลว การเปลี่ยนแปลงดังกล่าวเร่งตัวขึ้นในสัปดาห์นี้เมื่อผู้นำในอุตสาหกรรมสนับสนุนองค์ประกอบของการเรียกร้องของ CEO Anthropic Dario Amodei เพื่อ "ก้าว" การพัฒนา AI ชายแดนต่อ TechCrunch
เวลามีความสำคัญ รัฐบาลทั้งสองฝั่งมหาสมุทรแอตแลนติกกำลังชั่งน้ำหนักวิธีการดูแลระบบที่มีความสามารถก้าวหน้าเร็วกว่าโครงสร้างพื้นฐานการประเมินผล ข้อเสนอที่เกิดขึ้นภายในห้องปฏิบัติการ AI ชั้นนำ — และซึ่งรวมถึงการตรวจสอบก่อนเผยแพร่จริง — ช่วยให้ผู้กำหนดนโยบายมีเทมเพลตที่อุตสาหกรรมเองได้รับการรับรองในนาม ซึ่งในอดีตเป็นข้อกำหนดเบื้องต้นสำหรับกฎระเบียบ AI ที่มีความหมาย
สิ่งที่ต้องดู
ความเป็นอิสระด้านบรรณาธิการของสถาบันจาก Google จะเป็นการทดสอบครั้งแรก หากบทความยังคงมีจุดยืนที่ขัดแย้งกับแผนงานเชิงพาณิชย์ของ Google ดังที่บทความเกี่ยวกับความโปร่งใสมีเนื้อหาดังกล่าว สถานที่ดังกล่าวอาจกลายเป็นผู้มีส่วนร่วมสำคัญในการอภิปรายนโยบาย AGI หากเบี่ยงเบนไปสู่การส่งข้อความขององค์กร ก็จะเป็นช่องทางประชาสัมพันธ์อีกหนึ่งช่องทางในสาขาที่มีผู้คนหนาแน่น
ไม่ว่าจะด้วยวิธีใด เนื้อหาก็อยู่บนโต๊ะแล้ว: ข้อกำหนดในการประเมินก่อนเผยแพร่ การทดสอบที่จัดขึ้น และแม้แต่การชะลอตัวที่ประสานกัน กำลังถูกโต้แย้งต่อสาธารณะโดยหนึ่งในบุคคลที่ทรงพลังที่สุดใน AI คำถามไม่ได้อยู่ที่ว่าโมเดลชายแดนควรได้รับการประเมินอย่างอิสระอีกต่อไปหรือไม่ แต่คำถามคือใครเป็นผู้ประเมิน และกำหนดเวลาใด
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →