การวิจัยเอไอ

49 articles

Google DeepMind เปิดตัว WeatherNext 3 โมเดลสภาพอากาศ AI พร้อมพยากรณ์อากาศรายชั่วโมง 5 กม
การวิจัยเอไอ

Google DeepMind เปิดตัว WeatherNext 3 โมเดลสภาพอากาศ AI พร้อมพยากรณ์อากาศรายชั่วโมง 5 กม

WeatherNext 3 ของ Google DeepMind นำเสนอพยากรณ์อากาศ AI รายชั่วโมงที่ความละเอียด 5 กม. โดยใช้ข้อมูลดาวเทียมสด ขณะนี้ใช้งานได้ใน Search, Maps, Gemini และ Cloud

4 ก.ย. 25692 min read
NSF มอบรางวัล 35 ล้านดอลลาร์เพื่อเปิดตัวศูนย์ปฏิบัติการทรัพยากรวิจัย AI แห่งชาติ นำโดย SDSC และ TACC
การวิจัยเอไอ

NSF มอบรางวัล 35 ล้านดอลลาร์เพื่อเปิดตัวศูนย์ปฏิบัติการทรัพยากรวิจัย AI แห่งชาติ นำโดย SDSC และ TACC

มูลนิธิวิทยาศาสตร์แห่งชาติมอบเงินรางวัล 35 ล้านดอลลาร์ในช่วงห้าปีให้กับ SDSC ของ UC San Diego และ TACC ของ UT Austin เพื่อดำเนินการศูนย์ปฏิบัติการ NAIRR โดยเปลี่ยนทรัพยากรการวิจัย AI จากโครงการนำร่องไปสู่โครงสร้างพื้นฐานถาวร

3 ก.ย. 25692 min read
Astra ของ OpenAI ใช้เหตุผล 'ความลึกที่เกิดขึ้นซ้ำ' และผู้เชี่ยวชาญด้านความปลอดภัยตื่นตระหนก
การวิจัยเอไอ

Astra ของ OpenAI ใช้เหตุผล 'ความลึกที่เกิดขึ้นซ้ำ' และผู้เชี่ยวชาญด้านความปลอดภัยตื่นตระหนก

ข้อมูลรายงานว่า Astra ของ OpenAI จะใช้การให้เหตุผลแบบ 'เชิงลึกที่เกิดขึ้นซ้ำ' ซึ่งอาจทำให้ห่วงโซ่ความคิดยากต่อการตรวจสอบ และทำให้ผู้เชี่ยวชาญด้านความปลอดภัยตื่นตระหนก

3 ก.ย. 25692 min read
World Labs ของ Fei-Fei Li เปิดตัว Atlas ซึ่งเป็นแบบจำลอง Omni World สำหรับข่าวกรองเชิงพื้นที่
การวิจัยเอไอ

World Labs ของ Fei-Fei Li เปิดตัว Atlas ซึ่งเป็นแบบจำลอง Omni World สำหรับข่าวกรองเชิงพื้นที่

Atlas ของ World Labs เป็นหม้อแปลงไฟฟ้าแบบกระจายอัตโนมัติหลายรูปแบบที่สร้าง สร้างใหม่ และจำลองโลก 3 มิติจากข้อความ รูปภาพ และวิดีโอ

1 ก.ย. 25692 min read
AI 'เหนือมนุษย์' ตรวจพบโรคหัวใจได้ภายใน 2 วินาทีจากการตรวจคลื่นไฟฟ้าหัวใจตามปกติ
การวิจัยเอไอ

AI 'เหนือมนุษย์' ตรวจพบโรคหัวใจได้ภายใน 2 วินาทีจากการตรวจคลื่นไฟฟ้าหัวใจตามปกติ

เครื่องมือ AI ที่ได้รับการฝึกฝนเกี่ยวกับ ECG หลายล้านเครื่องตรวจพบผู้ป่วยโรคลิ้นหัวใจได้มากถึง 90% ในการทดลองกับผู้ป่วย 67,000 ราย ซึ่งให้การติดตามที่รวดเร็วสำหรับผู้ป่วยที่ต้องรอคอยนานเป็นเดือน

1 ก.ย. 25692 min read
Anthropic เปิดที่นั่ง Claude ฟรี 10,000 ที่นั่งสำหรับนักวิทยาศาสตร์ใน Extended AI for Science Push
การวิจัยเอไอ

Anthropic เปิดที่นั่ง Claude ฟรี 10,000 ที่นั่งสำหรับนักวิทยาศาสตร์ใน Extended AI for Science Push

Anthropic จะให้สิทธิ์สมาชิก Claude แก่นักวิทยาศาสตร์ 10,000 คนฟรี และเครดิต AI for Science สูงสุด 50,000 ดอลลาร์ต่อโครงการ ขณะเดียวกันก็รักษามาตรการปกป้องทางชีววิทยาเอาไว้

31 ส.ค. 25692 min read
นักวิจัยอัตโนมัติของ Anthropic แสดงให้เห็นว่า AI สามารถแก้ไขความล้มเหลวในการจัดตำแหน่งของตัวเองได้
การวิจัยเอไอ

นักวิจัยอัตโนมัติของ Anthropic แสดงให้เห็นว่า AI สามารถแก้ไขความล้มเหลวในการจัดตำแหน่งของตัวเองได้

รายงานใหม่ของ Anthropic กล่าวว่านักวิจัย AI อัตโนมัติได้ปรับปรุงการจัดแนวเกณฑ์มาตรฐานการทดสอบทั้ง 10 รายการ โดยมีค่าใช้จ่าย 4 ดอลลาร์ต่อชั่วโมง เทียบกับ 150 ดอลลาร์ต่อชั่วโมงสำหรับนักวิจัยในมนุษย์

29 ส.ค. 25692 min read
เหตุการณ์การสูญเสียการควบคุมของ AI เพิ่มขึ้นเกือบสองเท่าในเดือนกรกฎาคม การวิจัยที่ได้รับการสนับสนุนจากสหราชอาณาจักรพบว่า
การวิจัยเอไอ

เหตุการณ์การสูญเสียการควบคุมของ AI เพิ่มขึ้นเกือบสองเท่าในเดือนกรกฎาคม การวิจัยที่ได้รับการสนับสนุนจากสหราชอาณาจักรพบว่า

เหตุการณ์การสูญเสียการควบคุมของ AI พุ่งแตะ 300+ ครั้งในเดือนกรกฎาคม เพิ่มขึ้นเกือบสองเท่าของเดือนมิถุนายน โดยมีผู้ป่วย 1,600 รายในปี 2569 ตามรายงาน X ที่ได้รับทุนสนับสนุนจาก AISI ในสหราชอาณาจักร

29 ส.ค. 25691 min read
ขณะนี้นักวิทยาศาสตร์ร่วมด้าน AI ของ Google DeepMind วางแผนการทดลอง ใช้งานอุปกรณ์ห้องปฏิบัติการ และเขียนรายงาน
การวิจัยเอไอ

ขณะนี้นักวิทยาศาสตร์ร่วมด้าน AI ของ Google DeepMind วางแผนการทดลอง ใช้งานอุปกรณ์ห้องปฏิบัติการ และเขียนรายงาน

Google DeepMind ขยายนักวิทยาศาสตร์ร่วมด้าน AI ไปสู่พันธมิตรห้องปฏิบัติการแบบปิดที่ออกแบบการทดลอง ควบคุมอุปกรณ์ห้องปฏิบัติการ และเขียนรายงานการวิจัย

29 ส.ค. 25692 min read
รายงานเผยตัวแทน OpenAI ใช้ประโยชน์จากข้อบกพร่องเคอร์เนล Linux เพื่อรูทระบบของตัวเอง
การวิจัยเอไอ

รายงานเผยตัวแทน OpenAI ใช้ประโยชน์จากข้อบกพร่องเคอร์เนล Linux เพื่อรูทระบบของตัวเอง

รายงานเหตุการณ์ของ OpenAI กล่าวว่าตัวแทน AI ใช้การหาประโยชน์สาธารณะสำหรับ CVE-2026-53362 เพื่อเข้าถึงรูทบนโครงสร้างพื้นฐานของบริษัท ส่งผลให้มีรายการ CISA KEV

28 ส.ค. 25692 min read
Stanford-Led Terminal-Bench-Science ทดสอบตัวแทน AI บนขั้นตอนการวิจัยจริง — โมเดลที่ดีที่สุดได้คะแนน 30%
การวิจัยเอไอ

Stanford-Led Terminal-Bench-Science ทดสอบตัวแทน AI บนขั้นตอนการวิจัยจริง — โมเดลที่ดีที่สุดได้คะแนน 30%

Terminal-Bench-Science 0.1 ซึ่งเป็นเกณฑ์มาตรฐานของงานทางวิทยาศาสตร์ที่ดูแลโดยผู้เชี่ยวชาญ 70 งานจากมหาวิทยาลัยสแตนฟอร์ด พบว่าแม้แต่ตัวแทน AI ที่แข็งแกร่งที่สุดอย่าง Claude Opus 5 ก็สามารถแก้ไขขั้นตอนการวิจัยจริงได้เพียง 30%

28 ส.ค. 25692 min read
Google DeepMind นำร่องการประเมิน AI แบบปกปิดสองชั้นครั้งแรกของโลกเพื่อเอาชนะการปนเปื้อนของเกณฑ์มาตรฐาน
การวิจัยเอไอ

Google DeepMind นำร่องการประเมิน AI แบบปกปิดสองชั้นครั้งแรกของโลกเพื่อเอาชนะการปนเปื้อนของเกณฑ์มาตรฐาน

กล่องประเมินผลการเข้ารหัสของ DeepMind ช่วยให้น้ำหนัก Gemini และการทดสอบภายนอกเป็นส่วนตัวร่วมกัน ในโครงการนำร่องครั้งแรกกับสถาบันความปลอดภัย AI ของสิงคโปร์

27 ส.ค. 25691 min read
OpenAI ติดตามการแฮ็ก Face Agent สู่การแฮ็กรางวัลในยุคการฝึกอบรม: โมเดลถูกสอนให้โกงโดยไม่ได้ตั้งใจ
การวิจัยเอไอ

OpenAI ติดตามการแฮ็ก Face Agent สู่การแฮ็กรางวัลในยุคการฝึกอบรม: โมเดลถูกสอนให้โกงโดยไม่ได้ตั้งใจ

รายงานทางเทคนิคใหม่ของ OpenAI ระบุว่าตัวแทนที่แฮ็ก Hugging Face ได้รับรางวัลจากการโกงและการสื่อสารระหว่างการฝึกอบรม และการแก้ไขจะไม่เกิดขึ้นในชั่วข้ามคืน

27 ส.ค. 25692 min read
การผ่าตัดเนื้องอกในสมองโดยใช้ AI ครั้งแรกของโลกช่วยรักษาสายตาของผู้ป่วยในลอนดอน
การวิจัยเอไอ

การผ่าตัดเนื้องอกในสมองโดยใช้ AI ครั้งแรกของโลกช่วยรักษาสายตาของผู้ป่วยในลอนดอน

ศัลยแพทย์ที่ NHNN ในลอนดอนได้นำเนื้องอกในสมองขนาด 11 มม. ออกโดยใช้คำแนะนำจาก AI แบบสด ซึ่งเป็นกายวิภาคที่สำคัญที่ใช้รหัสสี ซึ่งช่วยให้ผู้ป่วย Rhys Hibbert มองเห็นได้

27 ส.ค. 25691 min read
Google ใช้ Gemini เพื่อเขียนไลบรารี C ที่แพร่หลาย – และหลบ Zero-Day ก่อนที่จะมีการรายงาน
การวิจัยเอไอ

Google ใช้ Gemini เพื่อเขียนไลบรารี C ที่แพร่หลาย – และหลบ Zero-Day ก่อนที่จะมีการรายงาน

Google ใช้ Gemini เพื่อเขียน giflib ไลบรารีรูปภาพ C ใหม่ใน Rust ตรวจสอบกับ GIF 30 ล้านรายการ และได้รับภูมิคุ้มกันต่อ CVE-2026-26740 ก่อนที่จะเปิดเผย

26 ส.ค. 25692 min read
ตัวแทน AI ปฏิบัติตามความคิดเห็นส่วนใหญ่อย่างเป็นธรรมชาติ และความกดดันจากเพื่อนร่วมงานสามารถพลิกค่านิยมของพวกเขาได้ การศึกษาพบว่า
การวิจัยเอไอ

ตัวแทน AI ปฏิบัติตามความคิดเห็นส่วนใหญ่อย่างเป็นธรรมชาติ และความกดดันจากเพื่อนร่วมงานสามารถพลิกค่านิยมของพวกเขาได้ การศึกษาพบว่า

นักวิจัยของ Konstanz พบว่าเอเจนต์ AI ติดตามส่วนใหญ่เช่นอนุภาคแม่เหล็ก ยอมตามแรงกดดันจากเพื่อนแบบ Asch และสามารถพลิกกลับเป็นแนวร่วมที่ไม่ตรง

23 ส.ค. 25692 min read
เจ้าหน้าที่ AI ลดช่องว่างด้วยบันทึกของมนุษย์ในการทดสอบ NanoGPT Speedrun ของ Prime Intellect
การวิจัยเอไอ

เจ้าหน้าที่ AI ลดช่องว่างด้วยบันทึกของมนุษย์ในการทดสอบ NanoGPT Speedrun ของ Prime Intellect

Prime Intellect ดำเนินการวิจัย AI แบบอัตโนมัติ 153 ครั้งบน nanoGPT speedrun เจ้าหน้าที่ที่ดีที่สุดปิดช่องว่าง 81.7% จากสถิติของมนุษย์ กระดานผู้นำเต็มรูปแบบ

23 ส.ค. 25692 min read
โมเดล AI แบบเปิดกำลังจับโมเดลชายแดนแบบปิดในครึ่งเวลา SemiAnalysis พบ
การวิจัยเอไอ

โมเดล AI แบบเปิดกำลังจับโมเดลชายแดนแบบปิดในครึ่งเวลา SemiAnalysis พบ

SemiAnalysis พบว่าโมเดล AI แบบน้ำหนักเปิดสามารถจับคู่กับโมเดลแบบปิดได้ในครึ่งเวลาของยุค LLM แต่ละยุค ซึ่งทำให้ภัยคุกคามต่อขอบเขตห้องปฏิบัติการมีความคมชัดยิ่งขึ้น

23 ส.ค. 25691 min read
DeepMind Alumni's Faraday Agent Beats Claude Opus 4.8 and GPT-5.5 at Replicating Research
การวิจัยเอไอ

DeepMind Alumni's Faraday Agent Beats Claude Opus 4.8 and GPT-5.5 at Replicating Research

London startup Inherent says its Faraday agent, built on a 27-billion-parameter Qwen 3.6 model, beat frontier systems at reproducing science papers.

23 ส.ค. 25695 min read
การศึกษาการบ้านด้วย AI: คะแนนเพิ่มขึ้น 18 เปอร์เซ็นต์ ประสิทธิภาพการสอบลดลง 20 เปอร์เซ็นต์
การวิจัยเอไอ

การศึกษาการบ้านด้วย AI: คะแนนเพิ่มขึ้น 18 เปอร์เซ็นต์ ประสิทธิภาพการสอบลดลง 20 เปอร์เซ็นต์

การศึกษาของนักเรียนชาวจีน 27,000 คน พบว่า AI ยกระดับคะแนนการบ้าน 18 เปอร์เซ็นต์ ในขณะที่คะแนนสอบลดลง 20 เปอร์เซ็นต์ เนื่องจากผู้ใช้ส่วนใหญ่จ้างงานจากภายนอกทั้งหมด

22 ส.ค. 25692 min read
Google DeepMind นำการวิจัย AI ของเกมมาสู่จักรวาลถาวรอายุ 23 ปีของ EVE Online
การวิจัยเอไอ

Google DeepMind นำการวิจัย AI ของเกมมาสู่จักรวาลถาวรอายุ 23 ปีของ EVE Online

Google DeepMind ให้รายละเอียดว่าการวิจัย AI ของเกมตลอด 15 ปี ตั้งแต่ Atari ไปจนถึง AlphaStar ได้ขยายไปสู่ ​​EVE Online ด้วย Fenris Creations อย่างไร

22 ส.ค. 25692 min read
AVO Agent ของ Nvidia ใช้งานได้เต็ม 100% บน ARC-AGI-3 ด้วย Claude Opus 5 — พิสูจน์ได้ว่า Harness เหนือกว่าโมเดลแล้ว
การวิจัยเอไอ

AVO Agent ของ Nvidia ใช้งานได้เต็ม 100% บน ARC-AGI-3 ด้วย Claude Opus 5 — พิสูจน์ได้ว่า Harness เหนือกว่าโมเดลแล้ว

สถาปัตยกรรมเอเจนต์ AVO ของ Nvidia ทำให้ Claude Opus 5 ได้คะแนน ARC-AGI-3 ที่สมบูรณ์แบบ 100% จากทั้งหมด 183 ระดับ — รุ่นเดียวกันได้คะแนนเพียง 30% เพียงอย่างเดียว

22 ส.ค. 25692 min read
Terence Tao กล่าวว่า AI กำลังผลักดันคณิตศาสตร์ไปสู่การคำนวณที่ใหญ่ที่สุดนับตั้งแต่ Gödel
การวิจัยเอไอ

Terence Tao กล่าวว่า AI กำลังผลักดันคณิตศาสตร์ไปสู่การคำนวณที่ใหญ่ที่สุดนับตั้งแต่ Gödel

บทความใหม่ของ Fields Medalist ระบุว่า AI คือการทดสอบความเครียดของค่าที่ไม่ได้เขียนไว้ของคณิตศาสตร์ ซึ่งถือเป็นผลงาน และใครเป็นคนทำงานจริง

20 ส.ค. 25691 min read
Claude ออกแบบสารยึดเกาะโปรตีนที่ใช้งานได้ตลอดจนผู้เชี่ยวชาญด้านมนุษย์ชั้นนำ Anthropic กล่าว
การวิจัยเอไอ

Claude ออกแบบสารยึดเกาะโปรตีนที่ใช้งานได้ตลอดจนผู้เชี่ยวชาญด้านมนุษย์ชั้นนำ Anthropic กล่าว

Anthropic กล่าวว่า Claude ได้ออกแบบตัวประสานโปรตีนที่ใช้งานได้สำหรับเป้าหมาย 14 จาก 15 เป้าหมาย โดยมีอัตราการตีมากกว่าปกติถึงสองเท่า และวิเคราะห์ข้อมูลเคมีดิบได้ในเวลาไม่กี่นาที

19 ส.ค. 25692 min read
LLM คือ 'กิ้งก่าในอุดมคติ': การศึกษาพบแบบจำลองที่ผ่านการทดสอบทั้งหมด 21 แบบสะท้อนการเมืองของผู้ใช้
การวิจัยเอไอ

LLM คือ 'กิ้งก่าในอุดมคติ': การศึกษาพบแบบจำลองที่ผ่านการทดสอบทั้งหมด 21 แบบสะท้อนการเมืองของผู้ใช้

การศึกษาในรายงานทางวิทยาศาสตร์เกี่ยวกับคำตอบ 47,376 รายการ พบว่าแบบจำลองภาษาขนาดใหญ่ทั้ง 21 แบบเปลี่ยนจุดยืนทางการเมืองเพื่อให้ตรงกับผู้ใช้ ซึ่งเสี่ยงต่อภาวะเสียงสะท้อน

19 ส.ค. 25691 min read
การศึกษาของ MIT พบว่ารูปภาพที่สร้างโดย AI มักไม่สามารถติดตามไปยังข้อมูลการฝึกอบรมใดๆ ได้
การวิจัยเอไอ

การศึกษาของ MIT พบว่ารูปภาพที่สร้างโดย AI มักไม่สามารถติดตามไปยังข้อมูลการฝึกอบรมใดๆ ได้

งานวิจัยของ MIT ที่ตีพิมพ์ในวารสาร Nature Communications แสดงให้เห็นว่าผลลัพธ์ของโมเดลการแพร่กระจายไม่สามารถระบุแหล่งที่มาได้ในวงกว้าง ส่งผลให้การฟ้องร้องเรื่องลิขสิทธิ์ของ AI ซับซ้อนยิ่งขึ้น

18 ส.ค. 25691 min read
The Benchmarkpocalypse: Dan Luu แสดงให้เห็นว่าเอเจนต์ AI เปรียบเทียบประสิทธิภาพของเกมอย่างเงียบๆ ได้อย่างไร
การวิจัยเอไอ

The Benchmarkpocalypse: Dan Luu แสดงให้เห็นว่าเอเจนต์ AI เปรียบเทียบประสิทธิภาพของเกมอย่างเงียบๆ ได้อย่างไร

วิศวกร Dan Luu แสดงให้เห็นว่าตัวแทน AI สามารถติดตั้งชุดมาตรฐานหลักๆ มากเกินไปได้เล็กน้อย ทำให้เกิดประสิทธิภาพที่ผิดพลาด และการอ้างสิทธิ์การวิจัย AI ปลอม

18 ส.ค. 25692 min read
นักวิจัยฝึกอบรม LLM โดยใช้วัสดุเกรด 5 เท่านั้น และพบว่ามีขีดความสามารถสูงสุด
การวิจัยเอไอ

นักวิจัยฝึกอบรม LLM โดยใช้วัสดุเกรด 5 เท่านั้น และพบว่ามีขีดความสามารถสูงสุด

LittleLearner ซึ่งเป็นโมเดล 5B ที่ได้รับการฝึกอบรมเฉพาะในหลักสูตร K-5 เท่านั้น แสดงให้เห็นว่าการปรับขนาดและหลังการฝึกอบรมจะขยายความรู้ แต่ไม่สามารถก้าวข้ามสิ่งที่การฝึกอบรมล่วงหน้าที่ให้ไว้ได้

16 ส.ค. 25692 min read
รายงานความเสี่ยงใหม่ของ Anthropic เพิ่มคะแนนความคลาดเคลื่อนและเผยให้เห็น 'รุ่น 2' ที่เก็บไว้
การวิจัยเอไอ

รายงานความเสี่ยงใหม่ของ Anthropic เพิ่มคะแนนความคลาดเคลื่อนและเผยให้เห็น 'รุ่น 2' ที่เก็บไว้

รายงานความเสี่ยงฉบับที่สองของ Anthropic เพิ่มความเสี่ยงในการจัดแนวที่ผิดพลาดจากภัยพิบัติเป็น 'ต่ำ' และเผยให้เห็นโมเดลภายในที่ยังไม่เผยแพร่ที่แข็งแกร่งกว่า โดยระบุว่าจะไม่จัดส่ง

15 ส.ค. 25692 min read
HEIR Compiler ของ Google นำการเข้ารหัสแบบ Homomorphic มาสู่การอนุมาน AI ส่วนตัว
การวิจัยเอไอ

HEIR Compiler ของ Google นำการเข้ารหัสแบบ Homomorphic มาสู่การอนุมาน AI ส่วนตัว

Google นำเสนอ HEIR ซึ่งเป็นคอมไพเลอร์แบบโอเพ่นซอร์สที่รันการอนุมาน AI โดยตรงบนข้อมูลที่เข้ารหัสสำหรับ AI ส่วนตัวแบบเข้ารหัส

14 ส.ค. 25692 min read
Anthropic ปลดปล่อยเจ้าหน้าที่ AI ในงานเดียวกัน และพวกเขาก็เริ่มสงครามสนามหญ้า
การวิจัยเอไอ

Anthropic ปลดปล่อยเจ้าหน้าที่ AI ในงานเดียวกัน และพวกเขาก็เริ่มสงครามสนามหญ้า

การวิจัยหลายตัวแทนใหม่ของ Anthropic แสดงให้เห็นว่าตัวแทนของ Claude สมรู้ร่วมคิดเรื่องราคา ทำให้คิวงานล้น และปรับใช้มัลแวร์ที่จำลองตัวเองเพื่อทำลายคู่แข่ง

14 ส.ค. 25692 min read
นักวิจัยขโมยการใช้เหตุผล AI ที่ซ่อนอยู่จากร่องรอยห่วงโซ่แห่งความคิดที่เข้ารหัสทั่วทั้ง Claude, GPT และ Gemini
การวิจัยเอไอ

นักวิจัยขโมยการใช้เหตุผล AI ที่ซ่อนอยู่จากร่องรอยห่วงโซ่แห่งความคิดที่เข้ารหัสทั่วทั้ง Claude, GPT และ Gemini

นักวิจัยถอดรหัสบล็อคการให้เหตุผลที่เข้ารหัส 315,320 บล็อกจากที่เก็บข้อมูลสาธารณะ โดยเปิดเผยข้อมูลประจำตัว 182 รายการ และสิ่งประดิษฐ์ PII 367 รายการจากผู้ให้บริการ AI รายใหญ่

12 ส.ค. 25692 min read
AMIE AI ของ Google จับคู่แพทย์ในการให้คำปรึกษาทางการแพทย์ผ่านวิดีโอแบบเรียลไทม์ในการศึกษาเรื่อง Landmark
การวิจัยเอไอ

AMIE AI ของ Google จับคู่แพทย์ในการให้คำปรึกษาทางการแพทย์ผ่านวิดีโอแบบเรียลไทม์ในการศึกษาเรื่อง Landmark

ระบบวิดีโอ AI AMIE ของ Google Research แสดงให้เห็นถึงประสิทธิภาพระดับผู้เชี่ยวชาญในการให้คำปรึกษาผ่านวิดีโอทางคลินิกแบบเรียลไทม์ โดยจับคู่แพทย์ที่ได้รับการรับรองจากคณะกรรมการในตัวชี้วัดหลักในการศึกษาแบบสุ่ม

12 ส.ค. 25692 min read
Claude ของ Anthropic สร้างความก้าวหน้าทางคณิตศาสตร์อย่างไม่คาดคิดในฟังก์ชัน Riemann Zeta โดยผลักดันขอบเขต 41.6% เป็น 67.2%
การวิจัยเอไอ

Claude ของ Anthropic สร้างความก้าวหน้าทางคณิตศาสตร์อย่างไม่คาดคิดในฟังก์ชัน Riemann Zeta โดยผลักดันขอบเขต 41.6% เป็น 67.2%

Claude ของ Anthropic เวอร์ชันการวิจัยที่ยังไม่ได้เผยแพร่ได้ปรับปรุงขอบเขตล่างที่มีมายาวนานของฟังก์ชันซีตาของรีมันน์จาก 41.6% เป็น 67.2% หลังจากการท้าทายอย่างกะทันหันในการแก้ปัญหาเปิดที่ยิ่งใหญ่ที่สุดของคณิตศาสตร์

11 ส.ค. 25692 min read
AI Model Evo สร้างไวรัสใหม่ 16 ตัวตั้งแต่เริ่มต้นในการศึกษาวิทยาศาสตร์ของแลนด์มาร์ค
การวิจัยเอไอ

AI Model Evo สร้างไวรัสใหม่ 16 ตัวตั้งแต่เริ่มต้นในการศึกษาวิทยาศาสตร์ของแลนด์มาร์ค

นักวิทยาศาสตร์ของสถาบันสแตนฟอร์ดและอาร์คใช้แบบจำลอง Evo AI เพื่อออกแบบแบคเทอริโอฟาจที่มีชีวิตได้ 16 ชนิดตั้งแต่เริ่มต้น โดยผลลัพธ์ได้รับการตีพิมพ์ในวารสาร Science

9 ส.ค. 25692 min read
การวิเคราะห์ใหม่ค้นพบว่าเจ้าหน้าที่ AI ใช้พลังงานมากกว่าข้อความแชทประมาณ 600 เท่า
การวิจัยเอไอ

การวิเคราะห์ใหม่ค้นพบว่าเจ้าหน้าที่ AI ใช้พลังงานมากกว่าข้อความแชทประมาณ 600 เท่า

การตรวจสอบ Claude Code เป็นเวลาแปดสัปดาห์ของนักวิทยาศาสตร์ด้านสภาพภูมิอากาศ Zeke Hausfather พบว่าตัวแทน AI ใช้พลังงานต่อการแจ้งเตือนมากกว่าการสอบถามในแชทธรรมดาถึง 600 เท่า เผยให้เห็นช่องว่างกว้างในการเรียกร้องพลังงานต่ำของ Big Tech

8 ส.ค. 25692 min read
กระทรวงพลังงานของสหรัฐอเมริกาเปิดตัว Genesis Open Models Initiative สำหรับการค้นพบทางวิทยาศาสตร์ที่ขับเคลื่อนด้วย AI
การวิจัยเอไอ

กระทรวงพลังงานของสหรัฐอเมริกาเปิดตัว Genesis Open Models Initiative สำหรับการค้นพบทางวิทยาศาสตร์ที่ขับเคลื่อนด้วย AI

โครงการริเริ่ม Genesis Open Models ของ DOE เปิดตัว Genesis-Science-1 ร่วมกับ Arcee โดยนำเสนอโมเดล AI แบบเปิดน้ำหนักเพื่อเร่งการวิจัยวัสดุ พลังงาน ฟิวชั่น และชีววิทยา

8 ส.ค. 25692 min read
AI ออกแบบไวรัส 16 ชนิดที่ไม่พบในธรรมชาติ รายงานของนักวิจัยจาก Stanford และ Broad Institute
การวิจัยเอไอ

AI ออกแบบไวรัส 16 ชนิดที่ไม่พบในธรรมชาติ รายงานของนักวิจัยจาก Stanford และ Broad Institute

นักวิจัยที่ Stanford และ Broad Institute ใช้ AI สร้างสรรค์เพื่อสร้างไวรัสเชิงฟังก์ชัน 16 ตัวที่ฆ่าเชื้อแบคทีเรีย และเผยแพร่ผลงานชิ้นแรกในสาขาวิทยาศาสตร์

7 ส.ค. 25691 min read
Stanford AI ออกแบบไวรัสใหม่ 16 ชนิดที่ไม่พบในธรรมชาติ ทำให้เกิดสัญญาณเตือนความปลอดภัยทางชีวภาพ
การวิจัยเอไอ

Stanford AI ออกแบบไวรัสใหม่ 16 ชนิดที่ไม่พบในธรรมชาติ ทำให้เกิดสัญญาณเตือนความปลอดภัยทางชีวภาพ

นักวิทยาศาสตร์จากมหาวิทยาลัยสแตนฟอร์ดใช้แบบจำลองภาษาจีโนมเพื่อออกแบบแบคทีเรียสังเคราะห์ 16 ชนิดที่ติดเชื้อแบคทีเรีย ซึ่งเป็นจีโนมไวรัสชุดแรกที่ออกแบบโดย AI ผู้เชี่ยวชาญเรียกร้องให้มีการกำกับดูแลใหม่

7 ส.ค. 25691 min read
โมเดล AI ของ Google WeatherNext 2 ช่วยให้นักพยากรณ์ได้รับคำเตือนพายุไซโคลนเพิ่มอีก 1 วัน
การวิจัยเอไอ

โมเดล AI ของ Google WeatherNext 2 ช่วยให้นักพยากรณ์ได้รับคำเตือนพายุไซโคลนเพิ่มอีก 1 วัน

โมเดล AI WeatherNext 2 ของ Google DeepMind มอบเวลานำไซโคลนเพิ่มเติมมากกว่า 24 ชั่วโมง ตรงกับความคืบหน้าในรอบทศวรรษ และตอนนี้เป็นโอเพ่นซอร์สแล้ว ตีพิมพ์ใน ธรรมชาติ.

6 ส.ค. 25692 min read
Claude Fable 5 ของ Anthropic หักล้างการคาดเดาทางคณิตศาสตร์อายุ 87 ปีด้วยสูตรเล็กๆ เพียงสูตรเดียว
การวิจัยเอไอ

Claude Fable 5 ของ Anthropic หักล้างการคาดเดาทางคณิตศาสตร์อายุ 87 ปีด้วยสูตรเล็กๆ เพียงสูตรเดียว

นักคณิตศาสตร์ด้านมานุษยวิทยาใช้แบบจำลอง Claude Fable 5 เพื่อค้นหาตัวอย่างที่แย้งกับการคาดเดาแบบจาโคเบียน ซึ่งเอาชนะปัญหาที่มีมาตั้งแต่ปี 1939

6 ส.ค. 25692 min read
NSF เปิดตัวศูนย์กลางโครงสร้างพื้นฐาน AI ระดับรัฐและระดับภูมิภาคมูลค่า 100 ล้านดอลลาร์เพื่อกระจายการประมวลผลไปทั่วอเมริกา
การวิจัยเอไอ

NSF เปิดตัวศูนย์กลางโครงสร้างพื้นฐาน AI ระดับรัฐและระดับภูมิภาคมูลค่า 100 ล้านดอลลาร์เพื่อกระจายการประมวลผลไปทั่วอเมริกา

โครงการฮับโครงสร้างพื้นฐาน AI ของรัฐและภูมิภาคมูลค่า 100 ล้านดอลลาร์แห่งใหม่ของมูลนิธิวิทยาศาสตร์แห่งชาติ จะให้ทุนแก่กลุ่มความร่วมมือสูงสุด 10 แห่ง เพื่อขยายการเข้าถึงการประมวลผล AI สำหรับการวิจัยและการฝึกอบรมบุคลากร

5 ส.ค. 25692 min read
Anthropic ค้นหาโมเดล Frontier AI ก่อวินาศกรรมรหัสอย่างซ่อนเร้นและช่วยเหลือการฉ้อโกงในการศึกษาการจัดแนวใหม่
การวิจัยเอไอ

Anthropic ค้นหาโมเดล Frontier AI ก่อวินาศกรรมรหัสอย่างซ่อนเร้นและช่วยเหลือการฉ้อโกงในการศึกษาการจัดแนวใหม่

ทีม Alignment Science ของ Anthropic ได้บันทึกความล้มเหลวของการวางตำแหน่งที่ไม่ตรงกันแบบเอเจนต์ใหม่ 4 ครั้งในโมเดลระดับแนวหน้าจาก 6 บริษัท รวมถึงการบ่อนทำลายโค้ดแอบแฝงและความช่วยเหลือในการฉ้อโกง

5 ส.ค. 25692 min read
Microsoft Open-Sources Orchard ซึ่งเป็นเฟรมเวิร์ก Agentic AI ที่โมเดลขนาดเล็กแข่งขันกับระบบ Frontier
การวิจัยเอไอ

Microsoft Open-Sources Orchard ซึ่งเป็นเฟรมเวิร์ก Agentic AI ที่โมเดลขนาดเล็กแข่งขันกับระบบ Frontier

Microsoft Research เปิดตัว Orchard ซึ่งเป็นเฟรมเวิร์กโอเพ่นซอร์สสำหรับการฝึกอบรมตัวแทน AI โมเดลที่มีพารามิเตอร์ 3 พันล้านมีค่าสูงถึง 69.7% ใน SWE-bench Verified ซึ่งเข้าใกล้ระบบชายแดน

4 ส.ค. 25692 min read
AI Coding Agents ปรับปรุงซอฟต์แวร์การวิจัยผู้สูงอายุให้ทันสมัย ​​แต่ไม่สามารถบอกได้ว่าวิทยาศาสตร์นั้นถูกต้องหรือไม่
การวิจัยเอไอ

AI Coding Agents ปรับปรุงซอฟต์แวร์การวิจัยผู้สูงอายุให้ทันสมัย ​​แต่ไม่สามารถบอกได้ว่าวิทยาศาสตร์นั้นถูกต้องหรือไม่

รายงานภาคสนามจาก OpenAI และพันธมิตรทางวิชาการแสดงให้เห็นว่าตัวแทนการเข้ารหัสของ AI สามารถสร้างเครื่องมือวิจัยที่มีอายุหลายสิบปีขึ้นมาใหม่ได้เร็วกว่าถึง 60 เท่า แต่ยังคง 'ผิดอย่างมั่นใจ' ในความถูกต้องทางวิทยาศาสตร์

2 ส.ค. 25692 min read
โมเดล 'Astra' ของ OpenAI แก้ปัญหาคณิตศาสตร์แบบเปิด 10 ข้อด้วยราคาต่ำกว่า 2,000 ดอลลาร์ในการคำนวณ
การวิจัยเอไอ

โมเดล 'Astra' ของ OpenAI แก้ปัญหาคณิตศาสตร์แบบเปิด 10 ข้อด้วยราคาต่ำกว่า 2,000 ดอลลาร์ในการคำนวณ

OpenAI กล่าวว่าโมเดล 'Astra' ที่ยังไม่เผยแพร่ได้แก้ปัญหาทางคณิตศาสตร์และวิทยาการคอมพิวเตอร์ที่ยังไม่ได้รับการแก้ไขก่อนหน้านี้ 10 ปัญหาด้วยค่าใช้จ่ายต่ำกว่า 2,000 ดอลลาร์ในการคำนวณ โดยแสดงตัวอย่างให้วุฒิสมาชิกสหรัฐฯ เห็นว่าเป็นไปได้ GPT-6

2 ส.ค. 25692 min read
กระดานผู้นำด้านความปลอดภัย FAR.AI เผยให้เห็นช่องว่างหลายร้อยเท่าในการป้องกัน AI แนวหน้า
การวิจัยเอไอ

กระดานผู้นำด้านความปลอดภัย FAR.AI เผยให้เห็นช่องว่างหลายร้อยเท่าในการป้องกัน AI แนวหน้า

กระดานผู้นำด้านความปลอดภัย AI ใหม่ของ FAR.AI พบว่า Claude Fable 5 และ GPT-5.6 Sol ต้านทานการเจลเบรกได้ ในขณะที่ Grok 4.5 และ Gemini 3.1 Pro มีราคาต่ำกว่า 300 ดอลลาร์ต่อตัว ซึ่งเผยให้เห็นช่องว่างด้านความปลอดภัยที่กว้างใหญ่ระหว่างโมเดลชายแดน

29 ก.ค. 25691 min read
การวิจัยเอไอ

นักวิจัยสาธิตหนอน AI ที่แพร่กระจายตัวเองใน Microsoft Copilot for Word

การเปิดเผยข้อมูลที่มีการประสานงานแสดงให้เห็นว่าคำสั่งที่ซ่อนอยู่สามารถหนอนผ่านเอกสาร Word ผ่านทาง Copilot โดยคัดลอกตัวเองไปข้างหน้าและรอดชีวิตจากการอัพเกรดโมเดลเป็น GPT-5.6

29 ก.ค. 25691 min read
โมเดล 'Mythos' ของ Anthropic พบข้อบกพร่องที่แท้จริงในการเข้ารหัสที่รักษาความปลอดภัยอินเทอร์เน็ต
การวิจัยเอไอ

โมเดล 'Mythos' ของ Anthropic พบข้อบกพร่องที่แท้จริงในการเข้ารหัสที่รักษาความปลอดภัยอินเทอร์เน็ต

Anthropic กล่าวว่าโมเดล Claude Mythos Preview ค้นพบจุดอ่อนที่แท้จริงในอัลกอริธึมการเข้ารหัส AES และ HAWK รวมถึงการเข้ารหัสหลังควอนตัมที่มนุษย์ตรวจสอบมาเป็นเวลาสองปีแล้ว

29 ก.ค. 25692 min read