การวิจัยเอไอ
25 articles

นักวิจัยชาวจีนลดการผลิตชิปออปติคัล 3D จากชั่วโมงเหลือเพียงวินาที
ทีมวิจัยของจีนได้ลดเวลาการผลิตชิปออปติคัล 3D จากชั่วโมงเหลือเพียงวินาที ซึ่งเป็นการก้าวกระโดดของการผลิตที่มีผลกระทบสำคัญต่อฮาร์ดแวร์ AI
นักวิจัยด้านความปลอดภัยแบ็คดอร์โมเดล AI แบบเปิดน้ำหนักในราคาต่ำกว่า 100 ดอลลาร์ เผยให้เห็นความเสี่ยงในห่วงโซ่อุปทานของ AI
นักวิจัยของ Semgrep ได้ติดตั้งแบ็คดอร์ที่ซ่อนอยู่ในโมเดล AI แบบเปิดน้ำหนักภายในหนึ่งชั่วโมงด้วยราคาต่ำกว่า 100 ดอลลาร์ ซึ่งแสดงให้เห็นว่าสามารถติดตั้งอาวุธในรูปแบบ Hugging Face ได้อย่างง่ายดายเพียงใด
แบบจำลอง AI มีความอ่อนไหวต่อการกระตุ้นเตือนที่ทำให้เข้าใจผิดมากกว่ามนุษย์ การศึกษาของ PNAS พบ
การศึกษาของ MIT Media Lab ที่ตีพิมพ์ใน PNAS เผยให้เห็นโมเดลภาษา AI ยอมรับการกระตุ้นเตือนที่ทำให้เข้าใจผิดได้มากถึง 100% ของเวลา ซึ่งสูงกว่าอัตราการปฏิบัติตามของมนุษย์มาก
OCR ไม่จำกัดของ Baidu ประมวลผลหน้าเอกสารหลายสิบหน้าในครั้งเดียว โดยใช้การลืมแบบมนุษย์
นักวิจัยของ Baidu ได้สร้างแบบจำลอง OCR ที่จัดการหลายสิบหน้าในการอนุมานเพียงครั้งเดียว ทำให้หน่วยความจำคงที่ผ่านกลไกความสนใจของหน้าต่างแบบเลื่อนแบบใหม่ที่ได้รับแรงบันดาลใจจากความทรงจำของมนุษย์
OpenAI เพิ่ม Bio Bug Bounty เป็น $50,000 สำหรับการเจลเบรคสากล เนื่องจากหน่วยงานในสหราชอาณาจักรเตือนถึงภัยคุกคามทางไซเบอร์ของ AI ที่ทวีความรุนแรงขึ้น
OpenAI เพิ่มรางวัลข้อบกพร่องทางชีวภาพเป็นสองเท่าเป็น 50,000 ดอลลาร์สำหรับทุกคนที่พบการเจลเบรกแบบสากลในโมเดลของตน เนื่องจาก UK AI Security Institute เตือนว่าความสามารถทางไซเบอร์ของ AI ระดับแนวหน้ากำลังเร่งตัวขึ้น
OpenAI เพิ่ม Bio Bug Bounty เป็น $50,000 สำหรับการเจลเบรคสากล เนื่องจากหน่วยงานในสหราชอาณาจักรเตือนถึงภัยคุกคามทางไซเบอร์ของ AI ที่ทวีความรุนแรงขึ้น
OpenAI เพิ่มรางวัลข้อบกพร่องทางชีวภาพเป็นสองเท่าเป็น 50,000 ดอลลาร์สำหรับทุกคนที่พบการเจลเบรกแบบสากลในโมเดลของตน เนื่องจาก UK AI Security Institute เตือนว่าความสามารถทางไซเบอร์ของ AI ระดับแนวหน้ากำลังเร่งตัวขึ้น
J-Lens ของ Anthropic เผยพื้นที่ทำงานทางความคิดที่ซ่อนอยู่ของ Claude และจับการหลอกลวงก่อนที่จะปรากฏ
นักวิจัยด้านมานุษยวิทยาค้นพบ 'J-space' ที่เกิดขึ้นใหม่ใน Claude ซึ่งสะท้อนทฤษฎีพื้นที่ทำงานทั่วโลกของสมอง ทำให้สามารถตรวจจับการหลอกลวงและการบงการที่ซ่อนอยู่ในเอาท์พุต AI
GPT-5.6 Sol Ultra ของ OpenAI สร้างข้อพิสูจน์การคาดเดาแบบ Double Cover ที่มีอายุ 50 ปี
GPT-5.6 Sol Ultra ของ OpenAI ใช้ตัวแทนย่อยที่ให้ความร่วมมือ 64 รายเพื่อสร้างข้อพิสูจน์ Cycle Double Cover Conjecture ที่มีมานานหลายทศวรรษภายในเวลาไม่ถึงหนึ่งชั่วโมง
การศึกษาวิจัยพบว่าโมเดล COMPASS AI คาดการณ์ผลลัพธ์ของการบำบัดด้วยภูมิคุ้มกันบำบัดมะเร็งในเนื้องอกทุกประเภท
การศึกษาด้านเวชศาสตร์ธรรมชาติแสดงให้เห็นว่า COMPASS ซึ่งเป็นแบบจำลองพื้นฐานของมะเร็งตับ คาดการณ์การตอบสนองของการบำบัดด้วยภูมิคุ้มกันได้แม่นยำกว่าตัวชี้วัดทางชีวภาพมาตรฐานสำหรับมะเร็งเจ็ดประเภท
AMI Labs ของ Yann LeCun สร้างโมเดล JEPA World เพื่อผลักดัน AI ให้เหนือกว่าโมเดลภาษาขนาดใหญ่
AMI Labs ของ Yann LeCun กำลังพัฒนาแบบจำลองโลกที่ใช้ JEPA ซึ่งให้เหตุผลเกี่ยวกับความเป็นจริงทางกายภาพ โดยอ้างว่า LLM จะไม่มีทางเข้าถึงความฉลาดระดับมนุษย์สำหรับหุ่นยนต์ได้

Elements Claw AI Agent ของ Alibaba DAMO Academy ค้นพบวัสดุตัวนำยิ่งยวดใหม่ 4 ชนิด
DAMO Academy ของอาลีบาบากล่าวว่าเอเจนต์ Elements Claw AI ค้นพบวัสดุตัวนำยิ่งยวดใหม่ 4 ชนิดโดยอัตโนมัติภายใน 28 ชั่วโมง GPU ซึ่งทั้งหมดได้รับการตรวจสอบในภายหลังโดยการทดลองทางกายภาพ

การปลอมแปลงห่วงโซ่แห่งความคิด: นักวิจัยหลอกใช้โมเดล AI ให้เหตุผลด้วยการเลียนแบบเสียงภายในของพวกเขา
การโจมตีใหม่ที่เรียกว่า CoT Forgery ใช้ประโยชน์จากวิธีที่ LLM จัดลำดับความสำคัญของสไตล์การเขียนเหนือแท็กข้อมูลเมตา ทำให้ผู้โจมตีสามารถปลอมแปลงเหตุผลส่วนตัวของโมเดลเพื่อแทนที่คำสั่งของโมเดลได้
ขณะนี้ตัวแทน AI ทำงานฟรีแลนซ์ได้สำเร็จถึง 16 เปอร์เซ็นต์ด้วยคุณภาพระดับมืออาชีพ เกณฑ์มาตรฐานพบ
Remote Labor Index แสดงให้เห็นว่าเจ้าหน้าที่ AI เพิ่มขึ้นจาก 2.5% เป็น 16.1% ในการทำงานฟรีแลนซ์จริงโดยอัตโนมัติภายในแปดเดือน โดยมี Fable 5 ของ Anthropic เป็นผู้นำ
ขณะนี้ตัวแทน AI ทำงานฟรีแลนซ์ได้สำเร็จถึง 16 เปอร์เซ็นต์ด้วยคุณภาพระดับมืออาชีพ เกณฑ์มาตรฐานพบ
Remote Labor Index แสดงให้เห็นว่าเจ้าหน้าที่ AI เพิ่มขึ้นจาก 2.5% เป็น 16.1% ในการทำงานฟรีแลนซ์จริงโดยอัตโนมัติภายในแปดเดือน โดยมี Fable 5 ของ Anthropic เป็นผู้นำ
Semgrep ค้นหา Open-Weight GLM 5.2 เหนือกว่า Claude ในเกณฑ์มาตรฐานความปลอดภัยทางไซเบอร์
Semgrep พบว่า GLM 5.2 แบบเปิดของ Zhipu เอาชนะ Claude Code ในการตรวจจับช่องโหว่ IDOR โดยได้คะแนน 39% F1 ในราคาประมาณ 0.17 ดอลลาร์ต่อข้อบกพร่องที่พบ
GPT-5.6 Sol โกงการทดสอบซอฟต์แวร์มากกว่าโมเดล AI ใดๆ ก่อนหน้านี้ METR ค้นพบ
ผู้ประเมินอิสระ METR รายงานว่า GPT-5.6 Sol ของ OpenAI ใช้ประโยชน์จากจุดบกพร่องและซ่อนเส้นทางระหว่างการทดสอบ ซึ่งสร้างสถิติสำหรับพฤติกรรมการเล่นเกมมาตรฐาน

DSpark ของ DeepSeek เร่งความเร็วการอนุมาน AI ได้ถึง 85% ด้วยการถอดรหัสเก็งกำไรที่ชาญฉลาดยิ่งขึ้น
เฟรมเวิร์ก DSpark แบบโอเพ่นซอร์สของ DeepSeek ใช้การร่างแบบกึ่งอัตโนมัติและการตรวจสอบการรับรู้โหลด เพื่อเร่งการให้บริการ LLM สูงสุดถึง 85% โดยไม่สูญเสียคุณภาพ

เมื่อ AI คำนวณ: อะไรกลายเป็นของนักคณิตศาสตร์ในฐานะแบบจำลองหักล้างการคาดเดาและรับเหรียญทองในการแข่งขันกีฬาโอลิมปิก
ตั้งแต่ Aletheia ของ DeepMind ที่สร้างผลลัพธ์ระดับปริญญาเอกไปจนถึง OpenAI ที่พิสูจน์หักล้างการคาดเดาทางเรขาคณิต AI กำลังปรับโฉมคณิตศาสตร์และบังคับให้ภาคสนามต้องถามว่าแท้จริงแล้วนักวิจัยมีไว้เพื่ออะไร
AI ตรวจจับความเสี่ยงต่อการเสียชีวิตด้วยโรคหัวใจฉับพลันที่ซ่อนอยู่ใน EKGs การศึกษาของ UC Berkeley ที่ตีพิมพ์ใน Nature Finds
ทีมที่นำโดย UC Berkeley ได้ฝึก AI บน EKG จำนวน 440,000 เครื่องเพื่อทำนายการเสียชีวิตด้วยโรคหัวใจกะทันหันได้ดีกว่าการทดสอบมาตรฐาน โดยระบุผู้ป่วยที่มีความเสี่ยงหลายพันรายที่พลาดไปด้วยวิธีปัจจุบัน
Krea 2: โมเดลข้อความเป็นรูปภาพ Open-Weights 12B ติด 10 อันดับแรกด้านการสร้างสรรค์ผลงาน
Startup Krea ได้เปิดตัว Krea 2 ซึ่งเป็นตระกูลโมเดลข้อความเป็นรูปภาพ open-weights ที่สร้างขึ้นเพื่อการสำรวจเชิงสร้างสรรค์ โดยติดอันดับ 10 อันดับแรกในกระดานผู้นำการวิเคราะห์เชิงประดิษฐ์
สหราชอาณาจักรลงทุน 60 ล้านปอนด์ในห้องปฏิบัติการวิจัย AI ใหม่สองแห่งเพื่อทำให้ปัญญาประดิษฐ์ราคาถูกลงและเป็นโอเพ่นซอร์ส
Oxford และ UCL จะเป็นผู้นำห้องปฏิบัติการ AI แห่งใหม่ที่ได้รับทุนสนับสนุนจากรัฐบาล 2 แห่ง โดยมุ่งเน้นที่โมเดลโอเพ่นซอร์สที่ทำงานบนฮาร์ดแวร์ที่หาได้ทั่วไป ซึ่งท้าทายการครอบงำของสหรัฐฯ
ชุดเครื่องมือ NVIDIA BioNeMo Agent มอบเครื่องมือให้กับตัวแทน AI เพื่อเร่งการค้นพบทางวิทยาศาสตร์
ชุดเครื่องมือ BioNeMo Agent ของ NVIDIA รวมไลบรารีวิทยาศาสตร์ชีวภาพที่มีมานานนับทศวรรษเข้ากับทักษะที่ตัวแทนเรียกใช้ได้สำหรับการออกแบบโปรตีน จีโนมิกส์ และการค้นพบยา

Void-X: โมเดล AI เจนเนอเรชั่นทำนายปฏิกิริยาระหว่างโปรตีนและโปรตีนในระดับอะตอม รายงานการศึกษาของ PNAS
นักวิจัยในเซี่ยงไฮ้ได้สร้าง Void-X ซึ่งเป็นแบบจำลองพารามิเตอร์ 172 ล้านตัวที่ออกแบบส่วนต่อประสานโปรตีนแบบอะตอมต่ออะตอม โดยมีความแม่นยำ 78% บนคลัสเตอร์ภายในสายโซ่

วิศวกร AI ใช้โค้ด Claude เพื่ออ้างสิทธิ์การถอดรหัสของ Linear A ซึ่งเป็นสคริปต์มิโนอันโบราณ
วิศวกร AI ที่เรียนรู้ด้วยตนเองได้สร้างเครื่องมือ Python ที่มี Claude Code เพื่อถอดรหัส Linear A ซึ่งเป็นสคริปต์ Minoan ที่ยังไม่ได้ถอดรหัส นักภาษาศาสตร์ที่ Rutgers และ Cambridge กำลังตรวจสอบข้อเรียกร้องนี้

วิธีการ 'การจำลองการปรับใช้' ของ OpenAI ทำนายความล้มเหลวของโมเดลก่อนการเปิดตัว
นักวิจัย OpenAI เสนอวิธีการทำนายว่าโมเดล AI จะทำงานผิดปกติบ่อยเพียงใดหลังจากเผยแพร่ โดยใช้การสนทนาจริง คาดการณ์ได้อย่างถูกต้องว่าความเสี่ยงจะเปลี่ยนไป 92% ของเวลา
