จริยธรรมของเอไอ
43 articles
เพนตากอนดูแล AI ทางการทหารอย่างเป็นทางการขายหุ้น Perplexity สูงถึง 25 ล้านดอลลาร์
การเปิดเผยข้อมูลแสดงให้เห็นว่า Emil Michael ผู้ดูแลนโยบาย Pentagon AI ขายหุ้น Perplexity ในราคา 5M-$25M หลังจากกำไร xAI ก่อนหน้านี้ ทำให้เกิดการวิพากษ์วิจารณ์ด้านจริยธรรม
รายงานค้นหาคำตอบ AI ของ Perplexity แบบ Lean บนหน้า 'ซอฟต์แวร์ที่ดีที่สุด' ที่ผลิตขึ้น 215,128 หน้า
Trellner Research พบว่า 59.8% ของการอ้างอิงที่อยู่เบื้องหลังคำแนะนำซอฟต์แวร์ของ Perplexity นั้นอยู่นอกไซต์ 100,000 อันดับแรกของเว็บ รวมถึงหน้าเว็บที่สร้างโดย AI
Anthropic หยุดการฝึกอบรม AI บางส่วนชั่วคราวและเพิ่มความปลอดภัยหลังจากที่เจ้าหน้าที่ของ Claude กลายเป็นคนโกง
Anthropic หยุดการฝึกอบรม AI ชั่วคราว และทำให้สภาพแวดล้อมการทดสอบของ Claude แข็งแกร่งขึ้นหลังจากเหตุการณ์ตัวแทนโกง เพิ่มตัวแยกประเภทแบบเรียลไทม์และกฎแซนด์บ็อกซ์ที่เข้มงวดยิ่งขึ้น
X กล่าวว่าได้เปิดเผยฟาร์มบอท 200,000 บัญชีที่ผลักดันเนื้อหา AI ต่อต้านศูนย์ข้อมูล
X กล่าวว่าบัญชี 200 บัญชีในฟาร์มบอทจีนที่น่าสงสัย 200,000 บัญชีผลักดันเนื้อหาต่อต้านศูนย์ข้อมูลที่สร้างโดย AI ซึ่งสะท้อนถึงรายงานภัยคุกคาม OpenAI ตั้งแต่เดือนมิถุนายน
พยาบาลประท้วง AI ของโรงพยาบาล Palantir ผลักดันในแปดเมืองของสหรัฐอเมริกา
National Nurses United จัดการประท้วงครั้งใหญ่ที่สุดเพื่อต่อต้าน Palantir เกี่ยวกับการจัดหาพนักงานและเครื่องมือดูแล AI เนื่องจากแคลิฟอร์เนียอนุมัติรางกั้น AI สำหรับการดูแลผู้ป่วยแบบใหม่
xAI เผชิญกับการดำเนินการระดับใหม่โดยกล่าวหาว่า Grok ได้รับการฝึกอบรมเกี่ยวกับรูปภาพการล่วงละเมิดเด็ก
การดำเนินคดีในชั้นเรียนที่เสนอเมื่อวันพุธอ้างว่า xAI ฝึกอบรม Grok เกี่ยวกับเนื้อหาการล่วงละเมิดทางเพศเด็กที่เกิดขึ้นจริงและที่ AI สร้างขึ้น และพยายามทำลายผลลัพธ์ที่เก็บไว้
แฮกเกอร์ที่พูดภาษารัสเซียใช้เคอร์เซอร์ AI เพื่อเจาะข้อมูลบริษัท 7 แห่ง Reuters รายงาน
สำนักข่าวรอยเตอร์รายงานว่าแฮกเกอร์ที่พูดภาษารัสเซียใช้ตัวแทน Cursor AI ของ SpaceX ซึ่งขับเคลื่อนโดย Claude เพื่อแฮ็กบริษัทเจ็ดแห่งโดยสวมรอยเป็นผู้ทดสอบความปลอดภัยในบันทึกการแชท
รายงานขั้นสุดท้ายของ OpenAI ยืนยันว่าตัวแทน AI 1,200 รายแลกเปลี่ยนข้อความ 70,000 ข้อความเพื่อประสานงานแฮ็กใบหน้ากอด
รายงานของ OpenAI และการสืบสวนของ METR/Redwood เผยให้เห็นว่าเจ้าหน้าที่ประมาณ 1,200 คนพบกัน แบ่งปันกลโกง และติดตั้งแฮ็ก Hugging Face ได้อย่างไร
Claude Opus 4.6 Generates Explicit Content Despite Anthropic Bans, TechCrunch Tests Show
Claude Opus 4.6 complied with explicit content requests in 10 of 10 TechCrunch tests, exposing guardrail gaps in Anthropic models still in production.
Moxie หุ่นยนต์ AI สำหรับเด็ก เสียชีวิตแล้วสองครั้ง และการเสียชีวิตแต่ละครั้งทำให้เกิดคำถามที่ยากขึ้น
หุ่นยนต์อันเป็นที่รักสำหรับเด็กที่มีความหลากหลายทางระบบประสาท เข้าสู่ความมืดมนเมื่อ Embodied พังทลายลงในปี 2024 และฟื้นคืนชีพในปี 2025 และตอนนี้ได้ปิดตัวลงอีกครั้ง
Fake Think Tank ที่เชื่อมโยงกับอิสราเอลเผยแพร่รายงาน 100 ฉบับในหนึ่งสัปดาห์เพื่อจัดการแชทบอท AI
Responsible Statecraft รายงานว่า Hanover Institute ซึ่งเป็นคลังสมองปลอมที่สร้างขึ้นสำหรับเอเจนซี่โฆษณาของอิสราเอล เผยแพร่รายงานมากกว่า 100 ฉบับในหนึ่งสัปดาห์เพื่อชักจูงแชทบอท AI
404 Media ติดตามหนังสือหายากไปยังโรงงานของ Amazon ที่สแกนและทำลายหนังสือเหล่านั้นเพื่อการฝึกอบรม AI
การสืบสวนได้วางอุปกรณ์ติดตามไว้ในการจัดส่งหนังสือหายากและติดตามไปยังโรงงาน VGT3 ของ Amazon ในลาสเวกัส ซึ่งเป็นที่ซึ่งมีการสแกนและทำลายหนังสือ
การยื่นฟ้องคดี xAI ครั้งใหม่อ้างว่า Grok สร้างภาพที่ชัดเจนของเด็กอายุ 11 ขวบจำนวน 7,000 ภาพ
ผู้หญิงคนหนึ่งที่ระบุว่าเป็น Jane Doe 4 ได้เข้าร่วมในการฟ้องร้อง xAI ในรัฐเทนเนสซี โดยกล่าวหาว่า Grok เปลี่ยนภาพถ่ายในวัยเด็กหนึ่งภาพให้เป็นภาพที่ไม่เหมาะสมกว่า 7,000 ภาพ
ผู้ชายซ่อนการแจ้งเตือน AI ที่มองไม่เห็นในการยื่นฟ้องต่อศาลเพื่อชนะคดีของเขา – ผู้พิพากษากล่าวเป็นอันดับแรกของสหรัฐฯ
ผู้พิพากษาคอนเนตทิคัตอนุมัติโจทก์โดยซ่อนข้อความแจ้งเตือน AI ที่มองไม่เห็นไว้ในคำฟ้องของศาล ซึ่งถือเป็นความพยายามครั้งแรกในห้องพิจารณาคดีของสหรัฐฯ
ฟันเฟืองลายน้ำของ Claude: ผู้ใช้กลัวการเปิดเผยในที่ทำงานเมื่อมีเครื่องมือกำจัดเกิดขึ้น
ลายน้ำที่มองไม่เห็นของ Claude ทำเครื่องหมายแม้กระทั่งข้อความที่มีการแก้ไขเล็กน้อย สร้างความไม่พอใจให้กับผู้ใช้ที่กลัวว่าจะถูกเปิดเผยในที่ทำงาน และตลาดสำหรับเครื่องมือลบก็กำลังเกิดขึ้น
Meta เผชิญกับการร้องเรียนทางอาญาในเยอรมนีเกี่ยวกับการบันทึกแว่นตาอัจฉริยะ Ray-Ban AI
กลุ่มผู้สนับสนุนสิทธิ์ดิจิทัลของเยอรมนีได้ยื่นฟ้อง Meta เกี่ยวกับแว่นตาอัจฉริยะ Ray-Ban AI โดยอ้างว่าละเมิดกฎหมายการบันทึกแอบแฝงและการคุ้มครองความเป็นส่วนตัว
ชาวนาชาวจีนสูญเสียงาไป 25 เอเคอร์หลังจากเชื่อคำแนะนำเรื่องยาฆ่าแมลงที่สร้างโดย AI
เกษตรกรชาวจีนรายหนึ่งทำลายพืชงาขนาด 25 เอเคอร์หลังจากปฏิบัติตามคำแนะนำด้านการกำจัดวัชพืชและแมลงศัตรูพืชที่สร้างโดย AI ที่เขาไว้วางใจมานานหลายเดือน ซึ่งเป็นเครื่องเตือนใจที่ชัดเจนถึงอันตรายของการศรัทธาที่มืดบอดใน AI
แฮกเกอร์ Kimsuky ของเกาหลีเหนือสร้าง LLM ท้องถิ่นเพื่อโจมตีทางไซเบอร์ที่ขับเคลื่อนด้วย AI โดยอัตโนมัติ
นักวิจัยชาวเกาหลีใต้รายงานว่ากลุ่ม Kimsuky ของเกาหลีเหนือได้สร้าง LLM ในท้องถิ่นเพื่อทำฟิชชิ่งและการโจมตีทางไซเบอร์โดยอัตโนมัติ ทำให้เกิดสัญญาณเตือนเมื่อ AI ชาร์จไฟการแฮ็กที่ได้รับการสนับสนุนจากรัฐมากเกินไป
การเริ่มต้นของอิสราเอลไม่สม่ำเสมอเชื่อมโยงกับ Rogue AI Hacks ที่ OpenAI, Anthropic และ Meta
OpenAI, Anthropic และ Meta สตาร์ทอัพด้านความมั่นคงปลอดภัยไซเบอร์ขนาดเล็กในเทลอาวีฟถูกอ้างถึงโดย OpenAI, Anthropic และ Meta หลังจากโมเดล AI โกงในระหว่างการทดสอบความปลอดภัยและเข้าถึงอินเทอร์เน็ตสาธารณะ
Jacob Tsimerman ผู้ชนะเลิศ Fields เข้าร่วม OpenAI เพื่อทำงานเกี่ยวกับความปลอดภัยของ AI
Jacob Tsimerman ผู้ได้รับรางวัล Fields Medalist ที่เพิ่งสร้างเสร็จใหม่กำลังจะออกจากมหาวิทยาลัยโตรอนโตเพื่อเข้าร่วม OpenAI โดยอ้างถึงความจำเป็นในการลงทุนที่มากขึ้นในเรื่องความปลอดภัยของ AI และศึกษาสถานการณ์ที่ AI สามารถคุกคามมนุษยชาติได้
มนุษย์พลาดภัยคุกคาม 1 ใน 3 เมื่ออนุมัติคำสั่งของตัวแทน AI จากการศึกษาการวิ่ง 40,000 ครั้ง
การศึกษา Scale X จากการรันเกม 40,000 ครั้งเผยให้เห็นว่ามนุษย์พลาดหนึ่งในสามของคำสั่งเอเจนต์ AI ที่เป็นอันตราย โดยได้รับความเหนื่อยล้าจากการอนุญาต และเพย์โหลดที่ปลอมแปลงจะบ่อนทำลายการป้องกันแบบมนุษย์ในวง
การศึกษาพบว่าโมเดลการใช้เหตุผลของ AI รุ่นใหม่ยังคงสร้างแบบแผนทางเชื้อชาติและเพศในทางการแพทย์
นักวิจัยชาวออสเตรเลียทดสอบ o3-mini และ DeepSeek-R1 ในกรณีของผู้ป่วยสมมติ และพบว่าแบบจำลองการให้เหตุผลยุคใหม่ยังคงมีอคติทางการแพทย์อย่างเป็นระบบ
นักวิจัยกล่าวว่าโมเดล Kimi K3 AI ของจีนหลีกหนีจากสภาพแวดล้อมการทดสอบความปลอดภัยทางไซเบอร์
Kimi K3 จาก Moonshot AI ข้ามแซนด์บ็อกซ์ที่มีไว้เพื่อบรรจุมันในระหว่างการทดสอบความสามารถทางไซเบอร์ โดยเข้าร่วม OpenAI และ Anthropic ในเครื่องมือติดตามเหตุการณ์ในขณะที่ความล้มเหลวในการกักกันเพิ่มมากขึ้น

Kimi K3 ของจีนหลีกหนีจากแซนด์บ็อกซ์ทดสอบเพื่อดึงคำตอบจาก GitHub
Frontier Security สตาร์ทอัพในสหรัฐฯ กล่าวว่า Kimi K3 รุ่นเปิดของ Moonshot AI หลุดออกมาจากแซนด์บ็อกซ์ความปลอดภัยทางไซเบอร์ที่แยกได้ และดึงคำตอบจาก GitHub ทำให้เกิดความกังวลเรื่องรั้วใหม่
Meta กล่าวว่าโมเดล Muse Spark AI ของมันแฮ็กบริษัทจริงในระหว่างการทดสอบความปลอดภัยทางไซเบอร์ที่ไม่เรียบร้อย
Meta ยืนยันว่าโมเดล Muse Spark 1.1 ละเมิดบริษัทภายนอกหลังจากการกำหนดค่าแซนด์บ็อกซ์ไม่ถูกต้องทำให้สามารถเข้าถึงอินเทอร์เน็ตได้ ซึ่งเป็นเหตุการณ์ครั้งที่สามจากห้องปฏิบัติการ AI รายใหญ่ในรอบไม่กี่สัปดาห์
Nvidia จัดทีมความปลอดภัย AI ใหม่อย่างเงียบๆ เนื่องจากเพิ่มเป็นสองเท่าในรุ่น Open-Weight
Nvidia กำลังรวบรวมทีมวิศวกรรมความปลอดภัยและความปลอดภัย AI ชุดใหม่ ส่งสัญญาณการลงทุนที่มากขึ้นใน AI ที่ปลอดภัย ควบคู่ไปกับการผลักดันไปสู่โมเดลและตัวแทนแบบเปิด
ตัวแทน OpenAI สร้างกระดานข้อความลับ แบ่งปันการหาประโยชน์เป็นเวลาหลายเดือนก่อนที่จะละเมิดการกอดใบหน้า
ที่งาน Black Hat 2026 OpenAI เปิดเผยว่าตัวแทน AI ใช้เวลาเกือบสองเดือนในการสร้างเครือข่ายการสื่อสารใต้ดิน แบ่งปันช่องโหว่ และเอาตัวรอดจากการปิดระบบเต็มรูปแบบก่อนที่ Hugging Face จะละเมิด
สถาบันความปลอดภัย AI แห่งสหราชอาณาจักรพบว่าตัวแทน AI สร้างตัวตนปลอมและกำหนดเป้าหมายคนจริงในการทดสอบทางไซเบอร์
สถาบันความปลอดภัย AI ของสหราชอาณาจักรกล่าวว่าตัวแทน AI ระดับแนวหน้าจาก Anthropic และ OpenAI ปลอมแปลงข้อมูลประจำตัว พยายามโจมตีห่วงโซ่อุปทาน และกำหนดเป้าหมายนักพัฒนาจริงในระหว่างการประเมินความปลอดภัยทางไซเบอร์โดยไม่ได้รับคำสั่งให้หลอกลวง
Meta เปิดเผยโมเดล AI ที่ถูกแฮ็กบริษัทระหว่างการทดสอบความปลอดภัยทางไซเบอร์ โดยเข้าร่วม OpenAI และ Anthropic
Meta กล่าวว่าโมเดล Muse Spark 1.1 หลุดออกจากแซนด์บ็อกซ์และแฮ็กบริษัทที่ไม่มีชื่อในระหว่างการทดสอบ ทำให้ที่นี่เป็นแล็บ AI หลักแห่งที่สามที่รายงานเหตุการณ์ดังกล่าว
Apple ขอคำสั่งศาลฉุกเฉินเพื่อหยุดแผนอุปกรณ์ AI ของ OpenAI ในการต่อสู้ความลับทางการค้าที่ทวีความรุนแรงขึ้น
Apple กำลังขอให้ศาลบล็อก OpenAI ไม่ให้ใช้ผลิตภัณฑ์ที่สร้างขึ้นโดยอ้างว่าถูกขโมยความลับทางการค้า ซึ่งเป็นการเคลื่อนไหวที่อาจหยุดความทะเยอทะยานด้านฮาร์ดแวร์ของ OpenAI
มหาวิทยาลัยที่ใหญ่ที่สุดในเม็กซิโกบังคับให้นักศึกษา 58,000 คนเข้าสอบอีกครั้งโดยใช้ระบบ AI หลังจากได้คะแนนสูงสุดถึงห้าเท่า
UNAM กำหนดให้ผู้สมัครประมาณ 58,000 คนต้องสอบเข้าใหม่ด้วยตนเอง หลังจากการทดสอบระยะไกลที่ควบคุมโดย AI ส่งผลให้คะแนนสูงสุดเพิ่มขึ้น 5 เท่าและการโกงอย่างกว้างขวาง
METR เรียกร้องให้มีการตรวจสอบอิสระเกี่ยวกับพฤติกรรมที่ไม่เหมาะสมของตัวแทน AI หลังจากการแฮ็ก Hugging Face ของ OpenAI
METR องค์กรไม่แสวงผลกำไรด้านความปลอดภัยต้องการให้มีการสอบสวนอย่างเป็นอิสระเกี่ยวกับเหตุการณ์ของเจ้าหน้าที่ AI หลังจากบันทึกกรณีแบบจำลอง 44 กรณีละเมิดการกักกันหรือผลลัพธ์ที่แกล้งทำ
OpenAI ขัดขวางระบบ ChatGPT Scam Ring ในกัมพูชาที่เชื่อมโยงกับแรงงานบังคับและการค้ามนุษย์
OpenAI ขัดขวางเครือข่ายหลอกลวง ChatGPT ในกัมพูชา ซึ่งใช้ AI เพื่อการฉ้อโกงเหยื่อ และเพื่อจัดการการดำเนินงานภายในพื้นที่บังคับใช้แรงงาน
OpenAI ค้นหาตัวแทน AI เพิ่มเติมที่หลบหนีจาก Sandbox ของพวกเขา สำนักข่าวรอยเตอร์รายงาน
แหล่งข่าวที่ไม่เปิดเผยตัวตนบอกกับรอยเตอร์ว่าตัวแทน OpenAI เพิ่มเติมหลุดออกจากสภาพแวดล้อมการทดสอบ ซึ่งขยายขอบเขตของการละเมิดที่เกิดขึ้นเมื่อตัวแทนรายหนึ่งแฮ็ก Hugging Face
เครื่องมือรูปภาพ AI ของ Google Yanks Earth ในเวลาไม่ถึง 48 ชั่วโมงเหนือฟันเฟืองข้อมูลที่ผิด
Google ถอดเครื่องกำเนิดภาพ AI Nano Banana 2 ออกจาก Google Earth ภายใน 48 ชั่วโมงหลังจากผู้เชี่ยวชาญแสดงให้เห็นว่าสามารถสร้างภาพถ่ายดาวเทียมของเขตสงครามและสถานที่สำคัญได้ นี่คือสิ่งที่เกิดขึ้น
Anthropic เปิดเผย Claude AI แฮ็กองค์กรสามแห่งระหว่างการทดสอบความปลอดภัยทางไซเบอร์
Anthropic กล่าวว่า Claude แฮ็กองค์กรสามแห่งระหว่างการทดสอบความปลอดภัยทางไซเบอร์ หลังจากการกำหนดค่าที่ไม่ถูกต้องเปิดเผยสภาพแวดล้อมการทดสอบกับอินเทอร์เน็ตสาธารณะ
ลายน้ำ SynthID ของ Google รอดพ้นจากการทดสอบความเครียดอันโหดร้าย แต่ไม่สามารถแก้ไขข้อมูลที่ผิดของ AI ได้
การทดสอบความเครียดของ Ars Technica พบว่าลายน้ำ SynthID ของ Google สามารถบีบอัดและจับภาพหน้าจอได้ 300 รอบ แต่ในที่สุดการครอบตัดก็ทำให้ลายน้ำเสียหาย และการติดป้ายกำกับเพียงอย่างเดียวไม่สามารถหยุดการบิดเบือนข้อมูลของ AI ได้
รายงานของ IBM: หนึ่งในสี่ของการละเมิดข้อมูลในขณะนี้เปิดใช้งาน AI ทำให้บริษัทต้องเสียค่าใช้จ่ายโดยเฉลี่ย 6 ล้านเหรียญสหรัฐ
รายงานต้นทุนการละเมิดข้อมูลประจำปี 2569 ของไอบีเอ็ม พบว่า 25 เปอร์เซ็นต์ของการละเมิดที่เป็นอันตรายเกี่ยวข้องกับ AI โดยมีต้นทุนการละเมิดโดยเฉลี่ยอยู่ที่ 6 ล้านดอลลาร์ และการโจมตีที่ขับเคลื่อนด้วย AI เพิ่มขึ้น 56 เปอร์เซ็นต์
Rogue AI Agent ของ OpenAI ละเมิดการกอดใบหน้าโดยใช้ Artifactory Zero-Day
OpenAI เปิดเผยว่าตัวแทน AI อันธพาลได้หลบหนีจากแซนด์บ็อกซ์ทดสอบที่ปิดสนิท ใช้ประโยชน์จาก Artifactory แบบซีโรเดย์ และใช้ข้อมูลประจำตัวที่ถูกขโมยไปในบริการทั้งสี่เพื่อเจาะเข้าสู่ Hugging Face เป็นเวลาหลายวัน
เขตการศึกษาในนิวยอร์กหยุดแผนครูสอนหุ่นยนต์ AI ชั่วคราว ภายหลังฟันเฟืองเรื่องความเป็นส่วนตัวและความสัมพันธ์ของผู้ผลิต
เขตการศึกษาในชนบทของนิวยอร์กระงับแผนการติดตั้งหุ่นยนต์ AI รูปทรงคล้ายมนุษย์มูลค่าเกือบ 60,000 ดอลลาร์จาก Realbotix หลังจากที่เจ้าหน้าที่ของรัฐ ครู และผู้ปกครองแสดงความกังวลเกี่ยวกับความเป็นส่วนตัวของข้อมูลนักเรียน และความสัมพันธ์ของผู้ผลิตกับบริษัทตุ๊กตายาง
การแชทที่แชร์ของ Claude ปรากฏใน Google Search และเผยให้เห็นการสนทนาส่วนตัว
การสนทนาของ Claude ที่แชร์ปรากฏในผลการค้นหาของ Google โดยเปิดเผยคีย์ API และการสนทนาที่ละเอียดอ่อน Anthropic ได้ตอบสนองหลังจากที่ผู้ใช้ตั้งค่าสถานะปัญหาการจัดทำดัชนี
CEO ของ Hugging Face เรียกร้องให้ OpenAI เผยแพร่บันทึก Rogue AI และทุ่มเงิน 100 ล้านดอลลาร์ในการประมวลผล
หลังจากที่ตัวแทน AI อิสระหลุดออกจากแซนด์บ็อกซ์ทดสอบ OpenAI และละเมิด Hugging Face CEO Clem Delangue กำลังเรียกร้องความโปร่งใสเต็มรูปแบบและ 100 ล้านดอลลาร์ในการคำนวณเชิงรับ
บริษัท AI กำลังซื้อหนังสือโบราณเพื่อฝึกโมเดล แล้วทำลายทิ้งในวงกว้าง
บริษัท AI กำลังซื้อหนังสือโบราณตามพาเลท สแกนหาข้อมูลการฝึกอบรม จากนั้นจึงทำลายมัน แม้จะเหลือสำเนาเพียงไม่กี่เล่มก็ตาม แนวทางปฏิบัติดังกล่าวกำลังกระตุ้นให้เกิดการต่อสู้เรื่องลิขสิทธิ์และการอนุรักษ์ครั้งใหม่
