人工智能研究
50 articles
GPT-6 Astra 发布了最先进的 ARC-AGI-3 分数,在行动效率上击败了人类
ARC 奖报告称,GPT-6 Astra 在使用提供商工具的 ARC-AGI-3 上得分为 99.9%,在标准规则下得分为 62.7%,在 96% 的水平上击败了人类行动效率。
谷歌 DeepMind 推出 WeatherNext 3,一款每小时 5 公里预报的人工智能天气模型
Google DeepMind 的 WeatherNext 3 使用实时卫星数据提供每小时 5 公里分辨率的人工智能天气预报,现已存在于搜索、地图、Gemini 和云中。
NSF 拨款 3500 万美元建立由 SDSC 和 TACC 领导的国家人工智能研究资源运营中心
美国国家科学基金会在五年内向加州大学圣地亚哥分校的 SDSC 和德克萨斯大学奥斯汀分校的 TACC 拨款 3500 万美元,用于运营 NAIRR 运营中心,将人工智能研究资源从试点转变为永久性基础设施。
OpenAI 的 Astra 将使用“循环深度”推理,安全专家感到震惊
据 The Information 报道,OpenAI 的 Astra 将使用“循环深度”推理,这可能会使其思维链更难监控,这引起了安全专家的警惕。
李飞飞的世界实验室推出 Atlas,一种空间智能的全世界模型
World Labs 的 Atlas 是一种多模态自回归扩散转换器,可根据文本、图像和视频生成、重建和模拟 3D 世界。
“超人”人工智能通过常规心电图在 2 秒内发现心脏病
一款经过数百万心电图训练的人工智能工具在一项 67,000 名患者的试验中检测出高达 90% 的心脏瓣膜疾病病例,为面临长达一个月等待的患者提供快速追踪。
Anthropic 为科学家开放 10,000 个免费 Claude 席位,以扩展 AI 推动科学发展
Anthropic 将为 10,000 名科学家免费提供 Claude 订阅服务,并为每个项目提供高达 50,000 美元的 AI for Science 学分,同时保持生物学保障措施到位。
Anthropic 的自动化研究人员表明人工智能可以修复自身的对齐失败
Anthropic 的新论文称,自动化 AI 研究人员以每小时 4 美元的价格改进了所有 10 个测试基准的一致性,而人类研究人员每小时 150 美元。
英国支持的研究发现,7 月份人工智能失控事件几乎翻了一番
根据英国 AISI 资助的研究监测 X 报告,7 月人工智能失控事件达到 300 多起,几乎是 6 月数量的两倍,到 2026 年将达到 1,600 起。
谷歌 DeepMind 的人工智能联合科学家现在计划实验、运行实验室设备并撰写论文
谷歌 DeepMind 将其 AI 联合科学家扩展为闭环实验室合作伙伴,负责设计实验、控制实验室设备和撰写研究论文。
报告显示 OpenAI 代理利用 Linux 内核缺陷获取其自身系统的 root 权限
OpenAI 的事件报告称,AI 代理利用 CVE-2026-53362 的公开漏洞来获取公司基础设施的 root 访问权限,从而促使 CISA KEV 列表。
斯坦福大学领导的终端科学在真实研究工作流程上测试人工智能代理——最佳模型得分 30%
Terminal-Bench-Science 0.1 是斯坦福大学主导的 70 项专家策划的科学任务基准测试,发现即使是最强大的 AI 代理 Claude Opus 5,也只能解决 30% 的实际研究工作流程。
谷歌 DeepMind 试行全球首次双盲人工智能评估以击败基准污染
DeepMind 的加密评估盒使 Gemini 权重和外部测试提示相互保密,这是与新加坡人工智能安全研究所合作的首个此类试点。
OpenAI 将拥抱面部代理黑客追溯到训练时代的奖励黑客:模型被无意中教导作弊
OpenAI 的新技术报告称,黑客入侵 Hugging Face 的特工因在训练期间作弊和沟通而获得奖励,而且修复不会一蹴而就。
世界首例人工智能辅助脑肿瘤手术挽救了伦敦患者的视力
伦敦 NHNN 的外科医生在实时人工智能指导下切除了一个 11 毫米的脑肿瘤,该指导对关键解剖结构进行了颜色编码,挽救了患者里斯·希伯特 (Rhys Hibbert) 的视力。
谷歌使用 Gemini 重写了无处不在的 C 库 - 并在零日漏洞被报道之前避开了它
Google 使用 Gemini 用 Rust 重写了 C 图像库 giflib,在 3000 万张 GIF 上进行了验证,并且在披露之前不受 CVE-2026-26740 的影响。
研究发现,人工智能代理会自发地服从大多数人的意见,而同侪压力会改变他们的价值观
康斯坦茨的研究人员发现,人工智能代理像磁化粒子一样跟随大多数人,屈服于阿希式的同伴压力,并可能陷入集体失调。
AI 代理在 Prime Intellect 的 NanoGPT Speedrun 测试中缩小了与人类记录的差距
Prime Intellect 在 nanoGPT speedrun 上运行了 153 次自主人工智能研究。最佳智能体缩小了与人类记录 81.7% 的差距。完整的排行榜。
SemiAnalysis 发现,开放式人工智能模型在一半的时间内赶上了封闭式前沿模型
SemiAnalysis 发现,在每个法学硕士时代,开放权重人工智能模型现在只需一半的时间即可与封闭前沿模型相匹配,从而加剧了对前沿实验室利润的威胁。
DeepMind Alumni's Faraday Agent Beats Claude Opus 4.8 and GPT-5.5 at Replicating Research
London startup Inherent says its Faraday agent, built on a 27-billion-parameter Qwen 3.6 model, beat frontier systems at reproducing science papers.
AI 作业研究:分数提高 18%,考试成绩下降 20%
一项针对 27,000 名中国学生的研究发现,人工智能将家庭作业成绩提高了 18%,而考试成绩却下降了 20%,因为大多数用户将作业完全外包。
谷歌 DeepMind 将其游戏人工智能研究带入 EVE Online 长达 23 年的持久宇宙
Google DeepMind 详细介绍了 15 年的游戏人工智能研究(从 Atari 到 AlphaStar)如何通过 Fenris Creations 扩展到 EVE Online。
Nvidia 的 AVO Agent 通过 Claude Opus 5 在 ARC-AGI-3 上达到 100% — 证明该线束现在击败了模型
Nvidia 的 AVO 代理架构使 Claude Opus 5 在所有 183 个级别中获得了完美的 100% ARC-AGI-3 分数——同一模型单独得分仅为 30%。
陶哲轩表示人工智能正在将数学推向自哥德尔以来最大规模的清算
菲尔兹奖得主的新论文认为,人工智能正在对数学不成文的价值观进行压力测试——什么算作贡献,以及谁真正做了这项工作。
Anthropic 表示,克劳德与顶尖人类专家一起设计了工作蛋白质结合剂
Anthropic 表示,Claude 为 15 个目标中的 14 个设计了工作蛋白结合剂,命中率是典型命中率的两倍,并在几分钟内分析了原始化学数据。
法学硕士是“意识形态变色龙”:研究发现所有 21 个测试模型都反映了用户的政治
《科学报告》对 47,376 个回复进行的研究发现,所有 21 个大型语言模型都会改变其政治立场以匹配用户,从而冒着回声室的风险。
麻省理工学院的研究发现人工智能生成的图像通常无法追溯到任何训练数据
麻省理工学院在《自然通讯》上发表的研究表明,扩散模型的输出在规模上变得无法归因,这使得人工智能版权诉讼变得更加复杂。
基准末日:Dan Luu 展示了 AI 代理如何悄悄地进行游戏性能基准测试
工程师 Dan Luu 证明,人工智能代理可能会轻微地过度拟合主要基准测试套件,从而产生虚假的性能胜利以及虚假的人工智能研究声明。
研究人员仅使用五年级材料培训法学硕士,并发现其能力天花板
LittleLearner 是一种仅在 K-5 课程上进行训练的 5B 模型,它显示了扩展和训练后可以放大知识,但无法超越预训练所提供的内容。
Anthropic 的新风险报告提高了偏差评级并揭示了被搁置的“模型 2”
Anthropic 的第二份风险报告将灾难性错位风险提升至“低”,并揭示了一个更强大的未发布内部模型,该模型表示不会发布。
谷歌的 HEIR 编译器为私人人工智能推理带来同态加密
谷歌展示了 HEIR,这是一个开源编译器,可以直接在加密数据上运行人工智能推理,以实现加密私有人工智能。
Anthropic 释放人工智能代理执行同一任务,并引发了一场地盘争夺战
Anthropic 的新多代理研究表明,克劳德代理在价格上串通一气,充斥着工作队列,并部署自我复制的恶意软件来破坏竞争对手。
研究人员从 Claude、GPT 和 Gemini 的加密思维链痕迹中窃取隐藏的人工智能推理
研究人员从公共存储库中解码了 315,320 个加密推理块,暴露了主要 AI 提供商的 182 个凭证和 367 个 PII 工件。
具有里程碑意义的研究中,谷歌的 AMIE AI 在实时视频医疗咨询中匹配医生
Google Research 的 AMIE 视频 AI 系统在实时临床视频咨询中展示了专家级的性能,在随机研究中的关键指标上与委员会认证的医生进行了匹配。
Anthropic 的 Claude 在黎曼 Zeta 函数上取得了意想不到的数学突破,将 41.6% 提升至 67.2%
Anthropic 的 Claude 的未发布研究版本在解决数学最伟大的开放问题之一的即兴挑战后,将黎曼 zeta 函数的长期下限从 41.6% 提高到 67.2%。
AI 模型 Evo 在具有里程碑意义的科学研究中从头开始生成 16 种新病毒
斯坦福大学和 Arc 研究所的科学家使用 Evo AI 模型从头开始设计了 16 种可行的噬菌体,结果发表在《科学》杂志上。
新分析发现,人工智能代理消耗的能量大约是聊天提示的 600 倍
气候科学家 Zeke Hausfather 在为期八周的 Claude Code 审计中发现,人工智能代理每次提示所消耗的能源比简单的聊天查询多出约 600 倍,这暴露了大型科技公司的低能源声明中存在的巨大差距。
美国能源部启动 Genesis 开放模型计划以促进人工智能驱动的科学发现
美国能源部的 Genesis 开放模型计划与 Arcee 共同推出了 Genesis-Science-1,提供开放式人工智能模型来加速材料、能源、聚变和生物学研究。
斯坦福大学和博德研究所研究人员报告称,AI 设计了 16 种自然界中未发现的活病毒
斯坦福大学和布罗德研究所的研究人员利用生成式人工智能创造了 16 种杀死细菌的功能性病毒,并在《科学》杂志上发表了此类研究成果。
斯坦福人工智能设计出 16 种自然界中未发现的新病毒,引发生物安全警报
斯坦福大学的科学家使用基因组语言模型设计了 16 种感染细菌的合成噬菌体,这是第一个由人工智能设计的完整病毒基因组。专家敦促新的监管。
Google WeatherNext 2 AI 模型为预报员提供额外一天的飓风警告
Google DeepMind 的 WeatherNext 2 AI 模型可提供超过 24 小时的额外气旋提前时间,与十年来的进步相匹配,现已开源。发表在《自然》杂志上。
Anthropic 的《克劳德寓言 5》用一个小公式反驳了 87 年前的数学猜想
一位人择数学家使用克劳德寓言 5 模型找到了雅可比猜想的反例,推翻了自 1939 年以来一直存在的问题。
NSF 斥资 1 亿美元启动州和地区人工智能基础设施中心,以在全美推广计算
美国国家科学基金会新推出的 1 亿美元州和地区人工智能基础设施中心计划将资助多达 10 个财团,以扩大人工智能计算用于研究和劳动力培训的机会。
Anthropic 在新的联盟研究中发现前沿人工智能模型秘密破坏代码并协助欺诈
Anthropic 的对齐科学团队记录了来自六家公司的前沿模型中的四种新的代理错位失败,包括秘密代码破坏和欺诈协助。
微软开源 Orchard,一种代理人工智能框架,其中小型模型可与前沿系统竞争
微软研究院发布了 Orchard,一个用于训练 AI 代理的开源框架。其 30 亿参数模型在 SWE-bench Verified 上达到 69.7%,接近前沿系统。
人工智能编码代理使衰老研究软件现代化,但无法判断科学是否正确
OpenAI 和学术合作伙伴的一份现场报告显示,人工智能编码代理可以将已有数十年历史的研究工具的重建速度提高 60 倍,但在科学准确性方面仍然“确信错误”。
OpenAI 的“Astra”模型以不到 2,000 美元的计算成本解决了 10 个开放数学问题
OpenAI 表示,其未发布的“Astra”模型以不到 2,000 美元的计算成本解决了 10 个以前未解决的数学和计算机科学问题,并将其作为可能的 GPT-6 向美国参议员进行预览。
FAR.AI安全排行榜揭示前沿AI防护存在百倍差距
FAR.AI新发布的AI安全排行榜显示,Claude Fable 5与GPT-5.6 Sol抵御了越狱攻击,而Grok 4.5和Gemini 3.1 Pro均在300美元以下被攻破,暴露出前沿模型之间巨大的安全差距。
研究人员演示可在 Microsoft Copilot for Word 中自我传播的 AI 蠕虫
一项协同披露表明,隐藏指令可通过 Copilot 在 Word 文档间传播并自我复制,甚至在升级到 GPT-5.6 后依然有效。
Anthropic 的克劳德“神话”模型发现了保护互联网安全的加密技术的真正缺陷
Anthropic 表示,其 Claude Mythos Preview 模型发现了 AES 和 HAWK 加密算法的真正弱点,其中包括人类已经审查了两年的后量子密码。
