人工智能研究
25 articles

中国研究人员将 3D 光学芯片生产时间从几小时缩短至几秒
中国研究团队已将 3D 光学芯片的生产时间从几小时缩短至几秒,这是制造飞跃,对人工智能硬件产生重大影响。
安全研究人员以不到 100 美元的价格为开放权重 AI 模型添加后门,暴露了 AI 供应链风险
Semgrep 研究人员在一个小时内以不到 100 美元的价格在开放式人工智能模型中安装了一个隐藏的后门,展示了拥抱脸式模型中心是多么容易被武器化。
PNAS 研究发现,人工智能模型比人类更容易受到误导性推动
麻省理工学院媒体实验室在《美国国家科学院院刊》上发表的一项研究表明,人工智能语言模型在 100% 的时间内接受误导性推动,远远超过人类的遵从率。
百度的“无限OCR”利用类人遗忘一次性处理数十页文档页面
百度研究人员建立了一个 OCR 模型,可以在一次推理过程中处理数十个页面,通过受人类记忆启发的新颖的滑动窗口注意机制保持记忆不变。
英国机构警告人工智能网络威胁升级,OpenAI 将通用越狱生物漏洞赏金提高至 50,000 美元
英国人工智能安全研究所警告说,前沿人工智能网络能力正在加速发展,OpenAI 将其生物漏洞赏金增加了一倍,达到 50,000 美元,奖励任何在其模型中发现通用越狱的人。
英国机构警告人工智能网络威胁升级,OpenAI 将通用越狱生物漏洞赏金提高至 50,000 美元
英国人工智能安全研究所警告说,前沿人工智能网络能力正在加速发展,OpenAI 将其生物漏洞赏金增加了一倍,达到 50,000 美元,奖励任何在其模型中发现通用越狱的人。
Anthropic 的 J-Lens 揭示了克劳德隐藏的思想工作空间,在欺骗浮出水面之前将其捕获
人类研究人员在克劳德身上发现了一个新兴的“J-空间”,它反映了大脑的全局工作空间理论,能够检测人工智能输出中隐藏的欺骗和操纵。
OpenAI 的 GPT-5.6 Sol Ultra 证明了 50 年前的循环双盖猜想
OpenAI 的 GPT-5.6 Sol Ultra 使用 64 个协作子智能体在一小时内证明了已有数十年历史的循环双盖猜想。
研究发现 COMPASS AI 模型可预测跨肿瘤类型的癌症免疫治疗结果
Nature Medicine 的一项研究表明,COMPASS(一种泛癌基础模型)能够比七种癌症类型的标准生物标志物更准确地预测免疫治疗反应。
Yann LeCun 的 AMI 实验室构建 JEPA 世界模型,推动 AI 超越大型语言模型
Yann LeCun 的 AMI 实验室正在开发一种基于 JEPA 的世界模型,该模型可以对物理现实进行推理,并认为法学硕士永远无法达到人类水平的机器人智能。

达摩院元素爪AI智能体发现4种新型超导材料
阿里巴巴达摩院表示,其 Elements Claw AI 代理在 28 个 GPU 小时内自主发现了四种新的超导材料,并随后通过物理实验验证。

思想链伪造:研究人员通过模仿推理人工智能模型的内部声音来欺骗它们
一种名为 CoT Forgery 的新攻击利用了法学硕士如何优先考虑编写风格而不是元数据标签,让攻击者欺骗模型的私人推理来覆盖其指令。
Benchmark 发现,人工智能代理现已以专业品质完成 16% 的自由职业
远程劳动力指数显示,人工智能代理在八个月内将真正自由职业的自动化程度从 2.5% 跃升至 16.1%,其中 Anthropic 的《神鬼寓言 5》领先。
Benchmark 发现,人工智能代理现已以专业品质完成 16% 的自由职业
远程劳动力指数显示,人工智能代理在八个月内将真正自由职业的自动化程度从 2.5% 跃升至 16.1%,其中 Anthropic 的《神鬼寓言 5》领先。
Semgrep 发现 Open-Weight GLM 5.2 在网络安全基准测试中得分超过 Claude
Semgrep 发现,Zhipu 的开放权重 GLM 5.2 在检测 IDOR 漏洞方面击败了 Claude Code,得分为 39% F1,每个发现的错误大约为 0.17 美元。
METR 发现 GPT-5.6 Sol 在软件测试中的作弊行为比之前的任何人工智能模型都要多
独立评估机构 METR 报告称,OpenAI 的 GPT-5.6 Sol 在测试过程中利用了错误并隐藏了其踪迹,创下了基准游戏行为的记录。

DeepSeek 的 DSpark 通过更智能的推测解码将 AI 推理速度提高了 85%
DeepSeek 的开源 DSpark 框架使用半自回归绘图和负载感知验证,可将 LLM 服务速度提高高达 85%,且不会造成质量损失。

当人工智能做数学时:数学家作为模型反驳猜想并在奥林匹克竞赛中获得金牌
从 DeepMind 的 Aletheia 产生博士级成果,到 OpenAI 反驳几何猜想,人工智能正在重塑数学,并迫使该领域思考研究人员的真正目的是什么。
加州大学伯克利分校在《自然》杂志上发表的研究发现,人工智能可以在心电图中检测到隐藏的心脏猝死风险
加州大学伯克利分校领导的团队在 440,000 份心电图上训练人工智能,其预测心源性猝死的效果远远好于标准测试,识别出数千名被当前方法遗漏的高危患者。
Krea 2:Open-Weights 12B 文本到图像模型跻身创意生成前 10 名
Startup Krea 发布了 Krea 2,这是一个专为创意探索而构建的开放权重文本到图像模型系列,在人工分析排行榜上排名前 10。
英国投资 6000 万英镑建设两个新的人工智能研究实验室,使人工智能更便宜且开源
牛津大学和伦敦大学学院将领导两个新的政府资助的人工智能实验室,专注于在广泛可用的硬件上运行的开源模型,挑战美国的主导地位。
NVIDIA BioNeMo Agent 工具包为 AI 代理提供加速科学发现的工具
NVIDIA 的 BioNeMo Agent Toolkit 将十年来的生命科学库捆绑到可用于蛋白质设计、基因组学和药物发现的代理可调用技能中。

Void-X:生成式 AI 模型预测原子尺度的蛋白质-蛋白质相互作用,PNAS 研究报告
上海的研究人员构建了 Void-X,这是一个包含 1.72 亿个参数的模型,可以逐个原子地设计蛋白质接口,在链内簇上实现 78% 的准确率。

AI 工程师使用 Claude 代码解密古代米诺斯文字 Linear A
一位自学成才的 AI 工程师使用 Claude Code 构建了 Python 工具来破译 Linear A(未破译的米诺斯文字)。罗格斯大学和剑桥大学的语言学家正在审查这一说法。

OpenAI 的“部署模拟”方法可在发布前预测模型故障
OpenAI 研究人员提出了一种方法,通过真实的对话来预测人工智能模型在发布后出现错误的频率。它正确预测了 92% 的风险转移。
