การวิจัยเอไอ

25 articles

นักวิจัยชาวจีนลดการผลิตชิปออปติคัล 3D จากชั่วโมงเหลือเพียงวินาที
การวิจัยเอไอ

นักวิจัยชาวจีนลดการผลิตชิปออปติคัล 3D จากชั่วโมงเหลือเพียงวินาที

ทีมวิจัยของจีนได้ลดเวลาการผลิตชิปออปติคัล 3D จากชั่วโมงเหลือเพียงวินาที ซึ่งเป็นการก้าวกระโดดของการผลิตที่มีผลกระทบสำคัญต่อฮาร์ดแวร์ AI

19 ก.ค. 25691 min read
นักวิจัยด้านความปลอดภัยแบ็คดอร์โมเดล AI แบบเปิดน้ำหนักในราคาต่ำกว่า 100 ดอลลาร์ เผยให้เห็นความเสี่ยงในห่วงโซ่อุปทานของ AI
การวิจัยเอไอ

นักวิจัยด้านความปลอดภัยแบ็คดอร์โมเดล AI แบบเปิดน้ำหนักในราคาต่ำกว่า 100 ดอลลาร์ เผยให้เห็นความเสี่ยงในห่วงโซ่อุปทานของ AI

นักวิจัยของ Semgrep ได้ติดตั้งแบ็คดอร์ที่ซ่อนอยู่ในโมเดล AI แบบเปิดน้ำหนักภายในหนึ่งชั่วโมงด้วยราคาต่ำกว่า 100 ดอลลาร์ ซึ่งแสดงให้เห็นว่าสามารถติดตั้งอาวุธในรูปแบบ Hugging Face ได้อย่างง่ายดายเพียงใด

17 ก.ค. 25692 min read
แบบจำลอง AI มีความอ่อนไหวต่อการกระตุ้นเตือนที่ทำให้เข้าใจผิดมากกว่ามนุษย์ การศึกษาของ PNAS พบ
การวิจัยเอไอ

แบบจำลอง AI มีความอ่อนไหวต่อการกระตุ้นเตือนที่ทำให้เข้าใจผิดมากกว่ามนุษย์ การศึกษาของ PNAS พบ

การศึกษาของ MIT Media Lab ที่ตีพิมพ์ใน PNAS เผยให้เห็นโมเดลภาษา AI ยอมรับการกระตุ้นเตือนที่ทำให้เข้าใจผิดได้มากถึง 100% ของเวลา ซึ่งสูงกว่าอัตราการปฏิบัติตามของมนุษย์มาก

13 ก.ค. 25692 min read
OCR ไม่จำกัดของ Baidu ประมวลผลหน้าเอกสารหลายสิบหน้าในครั้งเดียว โดยใช้การลืมแบบมนุษย์
การวิจัยเอไอ

OCR ไม่จำกัดของ Baidu ประมวลผลหน้าเอกสารหลายสิบหน้าในครั้งเดียว โดยใช้การลืมแบบมนุษย์

นักวิจัยของ Baidu ได้สร้างแบบจำลอง OCR ที่จัดการหลายสิบหน้าในการอนุมานเพียงครั้งเดียว ทำให้หน่วยความจำคงที่ผ่านกลไกความสนใจของหน้าต่างแบบเลื่อนแบบใหม่ที่ได้รับแรงบันดาลใจจากความทรงจำของมนุษย์

12 ก.ค. 25692 min read
OpenAI เพิ่ม Bio Bug Bounty เป็น $50,000 สำหรับการเจลเบรคสากล เนื่องจากหน่วยงานในสหราชอาณาจักรเตือนถึงภัยคุกคามทางไซเบอร์ของ AI ที่ทวีความรุนแรงขึ้น
การวิจัยเอไอ

OpenAI เพิ่ม Bio Bug Bounty เป็น $50,000 สำหรับการเจลเบรคสากล เนื่องจากหน่วยงานในสหราชอาณาจักรเตือนถึงภัยคุกคามทางไซเบอร์ของ AI ที่ทวีความรุนแรงขึ้น

OpenAI เพิ่มรางวัลข้อบกพร่องทางชีวภาพเป็นสองเท่าเป็น 50,000 ดอลลาร์สำหรับทุกคนที่พบการเจลเบรกแบบสากลในโมเดลของตน เนื่องจาก UK AI Security Institute เตือนว่าความสามารถทางไซเบอร์ของ AI ระดับแนวหน้ากำลังเร่งตัวขึ้น

11 ก.ค. 25692 min read
OpenAI เพิ่ม Bio Bug Bounty เป็น $50,000 สำหรับการเจลเบรคสากล เนื่องจากหน่วยงานในสหราชอาณาจักรเตือนถึงภัยคุกคามทางไซเบอร์ของ AI ที่ทวีความรุนแรงขึ้น
การวิจัยเอไอ

OpenAI เพิ่ม Bio Bug Bounty เป็น $50,000 สำหรับการเจลเบรคสากล เนื่องจากหน่วยงานในสหราชอาณาจักรเตือนถึงภัยคุกคามทางไซเบอร์ของ AI ที่ทวีความรุนแรงขึ้น

OpenAI เพิ่มรางวัลข้อบกพร่องทางชีวภาพเป็นสองเท่าเป็น 50,000 ดอลลาร์สำหรับทุกคนที่พบการเจลเบรกแบบสากลในโมเดลของตน เนื่องจาก UK AI Security Institute เตือนว่าความสามารถทางไซเบอร์ของ AI ระดับแนวหน้ากำลังเร่งตัวขึ้น

11 ก.ค. 25692 min read
J-Lens ของ Anthropic เผยพื้นที่ทำงานทางความคิดที่ซ่อนอยู่ของ Claude และจับการหลอกลวงก่อนที่จะปรากฏ
การวิจัยเอไอ

J-Lens ของ Anthropic เผยพื้นที่ทำงานทางความคิดที่ซ่อนอยู่ของ Claude และจับการหลอกลวงก่อนที่จะปรากฏ

นักวิจัยด้านมานุษยวิทยาค้นพบ 'J-space' ที่เกิดขึ้นใหม่ใน Claude ซึ่งสะท้อนทฤษฎีพื้นที่ทำงานทั่วโลกของสมอง ทำให้สามารถตรวจจับการหลอกลวงและการบงการที่ซ่อนอยู่ในเอาท์พุต AI

11 ก.ค. 25691 min read
GPT-5.6 Sol Ultra ของ OpenAI สร้างข้อพิสูจน์การคาดเดาแบบ Double Cover ที่มีอายุ 50 ปี
การวิจัยเอไอ

GPT-5.6 Sol Ultra ของ OpenAI สร้างข้อพิสูจน์การคาดเดาแบบ Double Cover ที่มีอายุ 50 ปี

GPT-5.6 Sol Ultra ของ OpenAI ใช้ตัวแทนย่อยที่ให้ความร่วมมือ 64 รายเพื่อสร้างข้อพิสูจน์ Cycle Double Cover Conjecture ที่มีมานานหลายทศวรรษภายในเวลาไม่ถึงหนึ่งชั่วโมง

11 ก.ค. 25692 min read
การศึกษาวิจัยพบว่าโมเดล COMPASS AI คาดการณ์ผลลัพธ์ของการบำบัดด้วยภูมิคุ้มกันบำบัดมะเร็งในเนื้องอกทุกประเภท
การวิจัยเอไอ

การศึกษาวิจัยพบว่าโมเดล COMPASS AI คาดการณ์ผลลัพธ์ของการบำบัดด้วยภูมิคุ้มกันบำบัดมะเร็งในเนื้องอกทุกประเภท

การศึกษาด้านเวชศาสตร์ธรรมชาติแสดงให้เห็นว่า COMPASS ซึ่งเป็นแบบจำลองพื้นฐานของมะเร็งตับ คาดการณ์การตอบสนองของการบำบัดด้วยภูมิคุ้มกันได้แม่นยำกว่าตัวชี้วัดทางชีวภาพมาตรฐานสำหรับมะเร็งเจ็ดประเภท

4 ก.ค. 25692 min read
AMI Labs ของ Yann LeCun สร้างโมเดล JEPA World เพื่อผลักดัน AI ให้เหนือกว่าโมเดลภาษาขนาดใหญ่
การวิจัยเอไอ

AMI Labs ของ Yann LeCun สร้างโมเดล JEPA World เพื่อผลักดัน AI ให้เหนือกว่าโมเดลภาษาขนาดใหญ่

AMI Labs ของ Yann LeCun กำลังพัฒนาแบบจำลองโลกที่ใช้ JEPA ซึ่งให้เหตุผลเกี่ยวกับความเป็นจริงทางกายภาพ โดยอ้างว่า LLM จะไม่มีทางเข้าถึงความฉลาดระดับมนุษย์สำหรับหุ่นยนต์ได้

4 ก.ค. 25692 min read
Elements Claw AI Agent ของ Alibaba DAMO Academy ค้นพบวัสดุตัวนำยิ่งยวดใหม่ 4 ชนิด
การวิจัยเอไอ

Elements Claw AI Agent ของ Alibaba DAMO Academy ค้นพบวัสดุตัวนำยิ่งยวดใหม่ 4 ชนิด

DAMO Academy ของอาลีบาบากล่าวว่าเอเจนต์ Elements Claw AI ค้นพบวัสดุตัวนำยิ่งยวดใหม่ 4 ชนิดโดยอัตโนมัติภายใน 28 ชั่วโมง GPU ซึ่งทั้งหมดได้รับการตรวจสอบในภายหลังโดยการทดลองทางกายภาพ

4 ก.ค. 25692 min read
การปลอมแปลงห่วงโซ่แห่งความคิด: นักวิจัยหลอกใช้โมเดล AI ให้เหตุผลด้วยการเลียนแบบเสียงภายในของพวกเขา
การวิจัยเอไอ

การปลอมแปลงห่วงโซ่แห่งความคิด: นักวิจัยหลอกใช้โมเดล AI ให้เหตุผลด้วยการเลียนแบบเสียงภายในของพวกเขา

การโจมตีใหม่ที่เรียกว่า CoT Forgery ใช้ประโยชน์จากวิธีที่ LLM จัดลำดับความสำคัญของสไตล์การเขียนเหนือแท็กข้อมูลเมตา ทำให้ผู้โจมตีสามารถปลอมแปลงเหตุผลส่วนตัวของโมเดลเพื่อแทนที่คำสั่งของโมเดลได้

3 ก.ค. 25691 min read
ขณะนี้ตัวแทน AI ทำงานฟรีแลนซ์ได้สำเร็จถึง 16 เปอร์เซ็นต์ด้วยคุณภาพระดับมืออาชีพ เกณฑ์มาตรฐานพบ
การวิจัยเอไอ

ขณะนี้ตัวแทน AI ทำงานฟรีแลนซ์ได้สำเร็จถึง 16 เปอร์เซ็นต์ด้วยคุณภาพระดับมืออาชีพ เกณฑ์มาตรฐานพบ

Remote Labor Index แสดงให้เห็นว่าเจ้าหน้าที่ AI เพิ่มขึ้นจาก 2.5% เป็น 16.1% ในการทำงานฟรีแลนซ์จริงโดยอัตโนมัติภายในแปดเดือน โดยมี Fable 5 ของ Anthropic เป็นผู้นำ

2 ก.ค. 25692 min read
ขณะนี้ตัวแทน AI ทำงานฟรีแลนซ์ได้สำเร็จถึง 16 เปอร์เซ็นต์ด้วยคุณภาพระดับมืออาชีพ เกณฑ์มาตรฐานพบ
การวิจัยเอไอ

ขณะนี้ตัวแทน AI ทำงานฟรีแลนซ์ได้สำเร็จถึง 16 เปอร์เซ็นต์ด้วยคุณภาพระดับมืออาชีพ เกณฑ์มาตรฐานพบ

Remote Labor Index แสดงให้เห็นว่าเจ้าหน้าที่ AI เพิ่มขึ้นจาก 2.5% เป็น 16.1% ในการทำงานฟรีแลนซ์จริงโดยอัตโนมัติภายในแปดเดือน โดยมี Fable 5 ของ Anthropic เป็นผู้นำ

2 ก.ค. 25692 min read
Semgrep ค้นหา Open-Weight GLM 5.2 เหนือกว่า Claude ในเกณฑ์มาตรฐานความปลอดภัยทางไซเบอร์
การวิจัยเอไอ

Semgrep ค้นหา Open-Weight GLM 5.2 เหนือกว่า Claude ในเกณฑ์มาตรฐานความปลอดภัยทางไซเบอร์

Semgrep พบว่า GLM 5.2 แบบเปิดของ Zhipu เอาชนะ Claude Code ในการตรวจจับช่องโหว่ IDOR โดยได้คะแนน 39% F1 ในราคาประมาณ 0.17 ดอลลาร์ต่อข้อบกพร่องที่พบ

29 มิ.ย. 25692 min read
GPT-5.6 Sol โกงการทดสอบซอฟต์แวร์มากกว่าโมเดล AI ใดๆ ก่อนหน้านี้ METR ค้นพบ
การวิจัยเอไอ

GPT-5.6 Sol โกงการทดสอบซอฟต์แวร์มากกว่าโมเดล AI ใดๆ ก่อนหน้านี้ METR ค้นพบ

ผู้ประเมินอิสระ METR รายงานว่า GPT-5.6 Sol ของ OpenAI ใช้ประโยชน์จากจุดบกพร่องและซ่อนเส้นทางระหว่างการทดสอบ ซึ่งสร้างสถิติสำหรับพฤติกรรมการเล่นเกมมาตรฐาน

28 มิ.ย. 25691 min read
DSpark ของ DeepSeek เร่งความเร็วการอนุมาน AI ได้ถึง 85% ด้วยการถอดรหัสเก็งกำไรที่ชาญฉลาดยิ่งขึ้น
การวิจัยเอไอ

DSpark ของ DeepSeek เร่งความเร็วการอนุมาน AI ได้ถึง 85% ด้วยการถอดรหัสเก็งกำไรที่ชาญฉลาดยิ่งขึ้น

เฟรมเวิร์ก DSpark แบบโอเพ่นซอร์สของ DeepSeek ใช้การร่างแบบกึ่งอัตโนมัติและการตรวจสอบการรับรู้โหลด เพื่อเร่งการให้บริการ LLM สูงสุดถึง 85% โดยไม่สูญเสียคุณภาพ

27 มิ.ย. 25692 min read
เมื่อ AI คำนวณ: อะไรกลายเป็นของนักคณิตศาสตร์ในฐานะแบบจำลองหักล้างการคาดเดาและรับเหรียญทองในการแข่งขันกีฬาโอลิมปิก
การวิจัยเอไอ

เมื่อ AI คำนวณ: อะไรกลายเป็นของนักคณิตศาสตร์ในฐานะแบบจำลองหักล้างการคาดเดาและรับเหรียญทองในการแข่งขันกีฬาโอลิมปิก

ตั้งแต่ Aletheia ของ DeepMind ที่สร้างผลลัพธ์ระดับปริญญาเอกไปจนถึง OpenAI ที่พิสูจน์หักล้างการคาดเดาทางเรขาคณิต AI กำลังปรับโฉมคณิตศาสตร์และบังคับให้ภาคสนามต้องถามว่าแท้จริงแล้วนักวิจัยมีไว้เพื่ออะไร

27 มิ.ย. 25692 min read
AI ตรวจจับความเสี่ยงต่อการเสียชีวิตด้วยโรคหัวใจฉับพลันที่ซ่อนอยู่ใน EKGs การศึกษาของ UC Berkeley ที่ตีพิมพ์ใน Nature Finds
การวิจัยเอไอ

AI ตรวจจับความเสี่ยงต่อการเสียชีวิตด้วยโรคหัวใจฉับพลันที่ซ่อนอยู่ใน EKGs การศึกษาของ UC Berkeley ที่ตีพิมพ์ใน Nature Finds

ทีมที่นำโดย UC Berkeley ได้ฝึก AI บน EKG จำนวน 440,000 เครื่องเพื่อทำนายการเสียชีวิตด้วยโรคหัวใจกะทันหันได้ดีกว่าการทดสอบมาตรฐาน โดยระบุผู้ป่วยที่มีความเสี่ยงหลายพันรายที่พลาดไปด้วยวิธีปัจจุบัน

25 มิ.ย. 25692 min read
Krea 2: โมเดลข้อความเป็นรูปภาพ Open-Weights 12B ติด 10 อันดับแรกด้านการสร้างสรรค์ผลงาน
การวิจัยเอไอ

Krea 2: โมเดลข้อความเป็นรูปภาพ Open-Weights 12B ติด 10 อันดับแรกด้านการสร้างสรรค์ผลงาน

Startup Krea ได้เปิดตัว Krea 2 ซึ่งเป็นตระกูลโมเดลข้อความเป็นรูปภาพ open-weights ที่สร้างขึ้นเพื่อการสำรวจเชิงสร้างสรรค์ โดยติดอันดับ 10 อันดับแรกในกระดานผู้นำการวิเคราะห์เชิงประดิษฐ์

24 มิ.ย. 25692 min read
สหราชอาณาจักรลงทุน 60 ล้านปอนด์ในห้องปฏิบัติการวิจัย AI ใหม่สองแห่งเพื่อทำให้ปัญญาประดิษฐ์ราคาถูกลงและเป็นโอเพ่นซอร์ส
การวิจัยเอไอ

สหราชอาณาจักรลงทุน 60 ล้านปอนด์ในห้องปฏิบัติการวิจัย AI ใหม่สองแห่งเพื่อทำให้ปัญญาประดิษฐ์ราคาถูกลงและเป็นโอเพ่นซอร์ส

Oxford และ UCL จะเป็นผู้นำห้องปฏิบัติการ AI แห่งใหม่ที่ได้รับทุนสนับสนุนจากรัฐบาล 2 แห่ง โดยมุ่งเน้นที่โมเดลโอเพ่นซอร์สที่ทำงานบนฮาร์ดแวร์ที่หาได้ทั่วไป ซึ่งท้าทายการครอบงำของสหรัฐฯ

24 มิ.ย. 25692 min read
ชุดเครื่องมือ NVIDIA BioNeMo Agent มอบเครื่องมือให้กับตัวแทน AI เพื่อเร่งการค้นพบทางวิทยาศาสตร์
การวิจัยเอไอ

ชุดเครื่องมือ NVIDIA BioNeMo Agent มอบเครื่องมือให้กับตัวแทน AI เพื่อเร่งการค้นพบทางวิทยาศาสตร์

ชุดเครื่องมือ BioNeMo Agent ของ NVIDIA รวมไลบรารีวิทยาศาสตร์ชีวภาพที่มีมานานนับทศวรรษเข้ากับทักษะที่ตัวแทนเรียกใช้ได้สำหรับการออกแบบโปรตีน จีโนมิกส์ และการค้นพบยา

23 มิ.ย. 25692 min read
Void-X: โมเดล AI เจนเนอเรชั่นทำนายปฏิกิริยาระหว่างโปรตีนและโปรตีนในระดับอะตอม รายงานการศึกษาของ PNAS
การวิจัยเอไอ

Void-X: โมเดล AI เจนเนอเรชั่นทำนายปฏิกิริยาระหว่างโปรตีนและโปรตีนในระดับอะตอม รายงานการศึกษาของ PNAS

นักวิจัยในเซี่ยงไฮ้ได้สร้าง Void-X ซึ่งเป็นแบบจำลองพารามิเตอร์ 172 ล้านตัวที่ออกแบบส่วนต่อประสานโปรตีนแบบอะตอมต่ออะตอม โดยมีความแม่นยำ 78% บนคลัสเตอร์ภายในสายโซ่

20 มิ.ย. 25692 min read
วิศวกร AI ใช้โค้ด Claude เพื่ออ้างสิทธิ์การถอดรหัสของ Linear A ซึ่งเป็นสคริปต์มิโนอันโบราณ
การวิจัยเอไอ

วิศวกร AI ใช้โค้ด Claude เพื่ออ้างสิทธิ์การถอดรหัสของ Linear A ซึ่งเป็นสคริปต์มิโนอันโบราณ

วิศวกร AI ที่เรียนรู้ด้วยตนเองได้สร้างเครื่องมือ Python ที่มี Claude Code เพื่อถอดรหัส Linear A ซึ่งเป็นสคริปต์ Minoan ที่ยังไม่ได้ถอดรหัส นักภาษาศาสตร์ที่ Rutgers และ Cambridge กำลังตรวจสอบข้อเรียกร้องนี้

20 มิ.ย. 25692 min read
วิธีการ 'การจำลองการปรับใช้' ของ OpenAI ทำนายความล้มเหลวของโมเดลก่อนการเปิดตัว
การวิจัยเอไอ

วิธีการ 'การจำลองการปรับใช้' ของ OpenAI ทำนายความล้มเหลวของโมเดลก่อนการเปิดตัว

นักวิจัย OpenAI เสนอวิธีการทำนายว่าโมเดล AI จะทำงานผิดปกติบ่อยเพียงใดหลังจากเผยแพร่ โดยใช้การสนทนาจริง คาดการณ์ได้อย่างถูกต้องว่าความเสี่ยงจะเปลี่ยนไป 92% ของเวลา

20 มิ.ย. 25692 min read