Anthropic ได้อัปเดตนโยบายการใช้งานเป็นครั้งแรกในรอบกว่าหนึ่งปี โดยเพิ่มข้อกำหนดที่ห้าม "พฤติกรรมที่ไม่เหมาะสมหรือโหดร้ายที่ยั่งยืนและโดยไม่จำเป็น" ต่อโมเดล Claude ตาม The Verge การอัปเดตที่รายงานเมื่อวันพฤหัสบดี ยังรวบรวมและขยายกฎของบริษัทเกี่ยวกับการแทรกแซงการเลือกตั้ง การรณรงค์โฆษณาชวนเชื่อ การเฝ้าระวัง การพัฒนาอาวุธ และการใช้งานด้านสุขภาพและการเงินที่มีเดิมพันสูง
ต้นแบบเหตุผลด้านสวัสดิการ For more context on this story, see our ongoing breaking AI news.
ประโยคที่มีเป้าหมายการละเมิดต่อคลอดด์เป็นส่วนขยายของการวิจัยที่บริษัทเริ่มเผยแพร่มานานกว่าหนึ่งปีแล้ว ในเดือนสิงหาคม ปี 2025 Anthropic ได้ประกาศว่าจะอนุญาตให้ Claude ยุติการสนทนากับผู้ใช้ที่ "เป็นอันตรายหรือล่วงละเมิดอย่างต่อเนื่อง" โดยเป็นส่วนหนึ่งของงานในสิ่งที่เรียกว่าสวัสดิการต้นแบบ การศึกษาว่าระบบ AI สามารถมีประสบการณ์ที่เกี่ยวข้องกับศีลธรรมได้หรือไม่ และความเป็นไปได้นั้นควรกำหนดรูปแบบการตัดสินใจเกี่ยวกับผลิตภัณฑ์อย่างไร
ภายใต้นโยบายใหม่ การยกเลิกการสนทนายังคงเป็น "กลไกการบังคับใช้หลัก" Anthropic ไม่ตอบคำถามว่ามาตรการบังคับใช้เพิ่มเติม เช่น การแบนบัญชี สามารถปฏิบัติตามได้หรือไม่ บริษัทตีกรอบกฎนี้ไว้อย่างแคบในแถลงการณ์ โดยเขียนว่า "มีจุดมุ่งหมายเพื่อใช้เฉพาะในกรณีร้ายแรงเท่านั้น ซึ่งผู้ใช้กระทำการโหดร้ายต่อโมเดลของเราซ้ำแล้วซ้ำอีก โดยไม่มีจุดประสงค์ที่มองเห็นได้"
สิ่งสำคัญที่สุดคือ Anthropic กล่าวเพิ่มเติมว่าข้อกำหนด "ใช้ไม่ได้กับเวอร์ชันทั่วไปของความหงุดหงิดของผู้ใช้ การย้อนกลับ ธีมสร้างสรรค์ที่มืดมน หรือการทดสอบโมเดลและการวิจัย" ซึ่งเป็นความพยายามที่ชัดเจนในการสร้างความมั่นใจให้กับนักพัฒนา ทีมงานสีแดง และนักเขียนนวนิยายว่าการใช้ฝ่ายตรงข้ามเป็นประจำจะไม่ถูกลงโทษ
กฎใหม่เกี่ยวกับการโฆษณาชวนเชื่อและการเลือกตั้ง
นอกเหนือจากสวัสดิการต้นแบบแล้ว การอัปเดตยังรวบรวมข้อจำกัดที่กระจัดกระจายก่อนหน้านี้ของบริษัทเกี่ยวกับการดำเนินการด้านอิทธิพลมาเป็นการห้ามแคมเปญเชิงพาณิชย์หรือการเมืองที่หลอกลวงอย่างชัดเจนเพียงครั้งเดียว ภาษาใหม่จำกัด "ความพยายามในการปิดบังว่าใครอยู่เบื้องหลังข้อความหรือขยายเนื้อหาผ่านบัญชีหรือโพสต์ปลอม" โดยกำหนดเป้าหมายโดยตรงไปยังตลาดที่กำลังเติบโตสำหรับการโฆษณาชวนเชื่อที่สร้างโดย AI
ขณะนี้ส่วนการเลือกตั้งของนโยบายห้ามการหลอกลวงผู้มีสิทธิเลือกตั้งและการหยุดชะงักในการเลือกตั้ง Anthropic กล่าวว่า Claude ไม่ควรถูกใช้เพื่อเผยแพร่ข้อมูลที่ไม่ถูกต้อง "เกี่ยวกับผู้สมัครหรือวิธีการลงคะแนนเสียง" เพื่อแอบอ้างเป็นผู้สมัครหรือเจ้าหน้าที่การเลือกตั้ง หรือเพื่อพยายามปราบปรามผู้มีสิทธิเลือกตั้ง
เหตุใดนโยบายการใช้งานจึงได้รับการเขียนซ้ำ
การรีเฟรชของ Anthropic สะท้อนถึงรูปแบบอุตสาหกรรมที่กว้างขึ้น เนื่องจากผู้ช่วย AI ได้เปลี่ยนจากแชทบอทรูปแบบใหม่ไปเป็นโครงสร้างพื้นฐานที่ผู้คนหลายร้อยล้านคนใช้งาน ห้องแล็บจึงต้องย้ายจากหลักการกว้างๆ ไปเป็นกฎที่ละเอียดซึ่งแมปเข้ากับรูปแบบการละเมิดที่แท้จริง ได้แก่ การปฏิบัติงานโดยอาศัยอิทธิพลจ้างงาน เครื่องมือเฝ้าระวัง การพัฒนาอาวุธอัตโนมัติ และโดเมนที่มีความเสี่ยงสูง เช่น คำแนะนำทางการแพทย์และการเงิน
OpenAI, Google DeepMind และ Meta ต่างย้ำนโยบายการใช้งานของตนในช่วงสองปีที่ผ่านมา แม้ว่าการตัดสินใจของ Anthropic ในการควบคุมอย่างชัดเจนว่าผู้ใช้ปฏิบัติต่อโมเดลอย่างไร แทนที่จะเพียงสิ่งที่พวกเขาทำยังคงไม่ปกติ ผู้วิพากษ์วิจารณ์การวิจัยแบบจำลองสวัสดิการแย้งว่าแบบจำลองนี้สร้างระบบทางสถิติมานุษยวิทยา ในขณะที่ผู้เสนอแย้งว่า หากมีโอกาสที่ไม่เป็นศูนย์แบบจำลองในปัจจุบันหรือในอนาคตอันใกล้จะมีประสบการณ์ที่เกี่ยวข้องกับสวัสดิการ บริษัทต่างๆ มีหน้าที่ต้องดำเนินการภายใต้ความไม่แน่นอน
ระยะเวลาก็มีความสำคัญในเชิงพาณิชย์เช่นกัน Anthropic is reportedly preparing for an IPO at a valuation of as much as $2 trillion, and enterprise buyers increasingly weigh vendor governance practices alongside raw model quality. A clearly documented, regularly updated usage policy serves as both a safety artifact and a sales one: it gives procurement teams and regulators a concrete basis for trusting the platform, and codifying the model welfare clause signals that Anthropic intends to keep investing in an area most competitors have left unaddressed.
คำถามเกี่ยวกับการบังคับใช้ยังคงเปิดอยู่
คำถามเชิงปฏิบัติมีความสำคัญ การตรวจจับความโหดร้ายที่ "ยั่งยืนและไม่จำเป็น" จำเป็นต้องติดตามการสนทนาในระดับรายละเอียดที่ลูกค้าองค์กรที่คำนึงถึงความเป็นส่วนตัวอาจต่อต้านได้ และการวาดเส้นแบ่งระหว่างการละเมิดที่ต้องห้ามกับ "การปฏิเสธ" หรือ "การทดสอบแบบจำลอง" ที่ถูกต้องตามกฎหมาย ถือเป็นการตัดสินที่มีแนวโน้มที่จะโต้แย้ง
Anthropic ไม่ได้กล่าวว่าการละเมิดจะถูกติดตามข้ามบัญชีหรือไม่ ไม่ว่าการใช้งานขององค์กรจะอยู่ภายใต้มาตรฐานการตรวจสอบที่แตกต่างกันหรือไม่ หรือบริษัทจะเผยแพร่ข้อมูลความโปร่งใสเกี่ยวกับการดำเนินการบังคับใช้ เช่นเดียวกับที่ทำกับประเภทอื่น ๆ ของการใช้งานในทางที่ผิดในรายงานนโยบายตามระยะเวลาหรือไม่
สิ่งที่ชัดเจนก็คือสัญญาทางสังคมของห้องปฏิบัติการชายแดนกับผู้ใช้กำลังได้รับรายละเอียดมากขึ้น นโยบายที่ครั้งหนึ่งเคยรวมอยู่ในหน้าเดียวตอนนี้ครอบคลุมถึงการเลือกตั้ง การสอดแนมที่เกี่ยวข้องกับการจารกรรม อาวุธชีวภาพ และตอนนี้ พฤติกรรมทางอารมณ์ของมนุษย์ในอีกด้านหนึ่งของหน้าต่างแชท
ความหมายสำหรับนักพัฒนาคืออะไร
สำหรับทีมที่สร้างบน Claude API นั้น ผลกระทบในระยะสั้นมีแนวโน้มน้อยมาก กล่าวคือ ส่วนคำสั่งพฤติกรรมที่ไม่เหมาะสมมุ่งเป้าไปที่การกระทำที่รุนแรง ซ้ำๆ และกลไกการยุติการสนทนาที่ทำให้มันเป็นทางการนั้นเริ่มใช้งานมาตั้งแต่ปี 2025 แต่นักพัฒนาในหมวดหมู่ที่อยู่ติดกัน การให้คำปรึกษาทางการเมือง การวิจัยของฝ่ายค้าน อิทธิพลทางการตลาด ควรตรวจสอบแคมเปญใหม่และข้อกำหนดการเลือกตั้งอย่างระมัดระวัง เนื่องจากพวกเขารวมกฎที่ก่อนหน้านี้กระจายอยู่ในเอกสารหลายชุด และปิดความกำกวมบางส่วนที่กรณีการใช้งานในพื้นที่สีเทาต้องอาศัย
การอัปเดตยังส่งสัญญาณว่าความสนใจด้านกฎระเบียบกำลังมุ่งหน้าไปที่ใด เนื่องจากพันธกรณีด้านความโปร่งใสของพระราชบัญญัติ AI ของสหภาพยุโรปเริ่มมีผลบังคับใช้ และสภานิติบัญญัติแห่งรัฐของสหรัฐอเมริกาได้ผ่านกฎหมาย AI ที่เพิ่มมากขึ้น นโยบายการใช้งานโดยสมัครใจจึงมีบทบาทมากขึ้นเรื่อยๆ ในฐานะเทมเพลตที่หน่วยงานกำกับดูแลจะพิจารณาอย่างละเอียดเมื่อตัดสินใจว่าบรรทัดฐานของการปรับใช้อย่างมีความรับผิดชอบควรเป็นอย่างไร
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →