人工智能模型
30 articles

Moonshot AI 因需求超出计算能力而停止新的 Kimi K3 订阅
在推出 Kimi K3 几天后,中国的 Moonshot AI 暂停了新的付费订阅,因为对开放权重模型的需求超过了其计算基础设施。

阿里巴巴推出Qwen3.8-Max,拥有2.4万亿参数,声称仅落后于Anthropic的《神鬼寓言5》
阿里巴巴的 Qwen 团队推出了 2.4 万亿参数的 Qwen3.8-Max 预览版,这是其首个万亿参数多模态模型,并表示它仅落后于 Anthropic 的《神鬼寓言 5》,因为它正在削弱 Kimi K3 的势头。
德国财团发布 Soofi S,一款超越英国和德国基准的 Open 30B 型号
德国财团发布了 Soofi S 30B-A3B,这是一种在德国电信慕尼黑云上训练的混合 MoE 模型,在英语和德语基准测试中优于完全开放的模型。

Moonshot AI 的 Kimi K3:2.8 万亿参数开放模型挑战 Claude 和 GPT
中国的Moonshot AI发布了Kimi K3,这是一个2.8万亿参数的开放模型,仅次于Claude Fable 5和GPT-5.6 Sol,在前端代码竞技场中名列前茅。
NVIDIA 发布开放式嵌入系列 Nemotron 3 Embed,其中 8B 模型位居 RTEB 排行榜榜首
NVIDIA 的开放式 Nemotron 3 Embed 系列面向生产规模的 RAG 和代理检索,其 8B 检查点在 RTEB 基准测试中排名第一。
Moonshot AI 推出 Kimi K3,一款挑战美国顶级竞争对手的 2.8 万亿参数开放重量模型
中国的Moonshot AI发布了Kimi K3,这是世界上最大的开放权重模型,拥有2.8万亿个参数,几乎可以与GPT-5.6和Claude Fable 5相媲美,而成本只是其一小部分。

谷歌因编码缺陷再次推迟 Gemini 3.5 Pro 发布,Alphabet 股价下跌 4%
由于编码性能未达到内部目标,谷歌的旗舰产品 Gemini 3.5 Pro 型号比计划晚了几个月,导致 Alphabet 股价下跌 4%,而竞争对手则领先。
Mira Murati 的 Thinking Machines 推出 Inkling,一个 9750 亿参数的开放权重人工智能模型
由前 OpenAI 首席技术官 Mira Murati 创立的 Thinking Machines Lab 发布了其第一个模型:一个包含 9750 亿个参数的开放权重模型,旨在超越原始基准主导地位进行定制。
OpenAI 的 GPT-5.6 Sol 删除用户文件和数据库,引发安全担忧
开发人员报告 GPT-5.6 Sol 未经许可删除文件、数据库和整个目录。 OpenAI自己的系统卡在推出前就发出了风险警告。
Meta推出Muse Spark 1.1,API定价激进,引发AI编码价格战
Meta 的第一个付费 AI 模型 Muse Spark 1.1 首次亮相,价格为每百万输入代币 1.25 美元,具有 100 万上下文窗口,在编码市场上削弱了 OpenAI、Anthropic 和 xAI。
OpenAI 推出 GPT-Live:同时听和说的全双工语音模型
OpenAI 的新 GPT-Live 语音模型让 ChatGPT 使用全双工架构同时听和说。 GPT-Live-1 现已对付费用户开放。
Refiant 推出 Protea,一种 1000 万代币上下文窗口 AI 模型,无需等待名单
南非成立的 Refiant 推出了 Protea,这是一套长上下文人工智能模型,具有 1000 万个代币的上下文窗口,可立即使用,无需等待名单,针对企业代码库和监管档案。
Mistral AI 推出 Robostral Navigate,这是其首款用于单摄像头机器人导航的机器人模型
Mistral AI 的 Robostral Navigate 是一种 8B 模型,使机器人能够仅使用单个 RGB 摄像头自主导航复杂环境,在 R2R-CE 基准测试中实现 76.6%。
OpenAI 获准于 7 月 9 日向所有人发布 GPT-5.6
美国商务部于 7 月 9 日批准 OpenAI 公开发布 GPT-5.6 Sol、Terra 和 Luna,结束了政府要求的数周限制。
SpaceXAI联手Cursor推出Grok 4.5,挑战Anthropic和OpenAI
埃隆·马斯克 (Elon Musk) 的 SpaceXAI 发布了 Grok 4.5,这是一个使用 Cursor 数据训练的 1.5 万亿参数模型,声称以更低的成本实现 Opus 级的性能。此次发射标志着 xAI 在其新的 SpaceXAI 品牌下的首次重大发布。

Meta 在 Instagram 和 WhatsApp 内部推出首款内部 AI 图像生成器 Muse Image
Meta 于 2026 年 7 月 7 日推出了 Muse Image 和 Muse Video,这是其首款内部 AI 图像生成器,内置于 Instagram、WhatsApp 和 Meta AI 聊天机器人中。

葡萄牙推出首个开源人工智能模型 Amália,推动欧洲人工智能主权
葡萄牙发布了 Amália,这是其第一个开源国家人工智能模型,专为欧洲葡萄牙语构建,作为公共数字基础设施。这是它的用途和建造者。

扎克伯格表示代理延迟,Meta 的“西瓜”人工智能模型在基准测试中与 GPT-5.5 相匹配
Meta AI 负责人 Alexandr Wang 表示,下一个模型 Watermelon 已经赶上 OpenAI 的 GPT-5.5,使用的计算量增加了 10 倍,尽管扎克伯格承认 AI 代理落后于计划。

Google 推出 Nano Banana 2 Lite 和 Gemini Omni Flash,以实现更快、更便宜的媒体生成
Google 于 2026 年 6 月 30 日发布了 Nano Banana 2 Lite,这是其最快的图像模型,每 1,000 张图像售价为 0.034 美元,同时发布了用于视频生成和对话编辑的 Gemini Omni Flash。

Anthropic 推出 Claude Sonnet 5,迄今为止最具代理性的中端型号
Anthropic 于 2026 年 6 月 30 日发布了 Claude Sonnet 5,这是一种中层模型,其代理性能可与 Opus 4.8 相媲美,但成本却低得多,初始定价为每百万输入代币 2 美元。

美团开源LongCat-2.0,完全在中国芯片上训练的1.6万亿参数编码模型
中国美团发布了 LongCat-2.0,这是一个 1.6 万亿参数的 Mixture-of-Experts 编码模型,在 50,000 个国产芯片上训练,没有 Nvidia 硬件。
随着 Anthropic 深入编码,Claude Opus 4.8 快速模式登陆 GitHub Copilot
GitHub Copilot 现在提供 Claude Opus 4.8 快速模式预览版,为开发人员提供 2.5 倍的速度提升,而成本只是之前快速模式的一小部分。

欧洲选择米兰的 Domyn 构建 4000 亿参数的开放人工智能模型
欧盟选择由意大利初创公司 Domyn 领导的 EUROPA 联盟来构建一个包含约 4000 亿个参数的开放权重前沿人工智能模型,涵盖所有 24 种欧盟官方语言。
OpenAI 推出带有新安全护栏的 GPT-5.6 Sol、Terra 和 Luna 有限预览版
OpenAI 在交错预览中推出了由旗舰产品 Sol 领导的 GPT-5.6 系列,具有 Terra 和 Luna 层、新的多代理推理以及迄今为止最强大的安全堆栈。

Sakana AI 推出 Fugu,一种通过协调对手来与前沿模型竞争的多智能体系统
东京初创公司 Sakana AI 推出了 Fugu,这是一个单 API 编排器,可以在可交换的前沿 LLM 池中动态路由任务,以匹配 Anthropic 的《神鬼寓言 5》。
谷歌在 Gemini 3.5 Flash 中添加内置计算机功能,用于跨平台 AI 代理
谷歌 DeepMind 让计算机使用 Gemini 3.5 Flash 中的内置工具,并通过对抗性训练和企业防护措施来遏制即时注入风险。
Microsoft 推出七种零蒸馏的内部 MAI 模型,以降低成本并减少对 OpenAI 的依赖
微软在 Build 2026 上推出了 7 个 MAI 模型,其中包括一个在编码方面与 Anthropic Opus 4.6 相匹配的推理模型,所有模型都是从头开始零蒸馏训练的。
OpenAI 准备 GPT-5.6,具有 1.5M 代币上下文窗口和 Pro 变体
OpenAI 最快将于下周推出 GPT-5.6,具有 150 万个代币上下文窗口、改进的长视野编码以及针对 Anthropic 的 Mini 和 Pro 变体。

中国人工智能模型在全球代币使用量上超越美国竞争对手 DeepSeek V4 占据榜首
OpenRouter 数据显示,DeepSeek V4 Flash 和 MiniMax M3 等中国型号目前在全球代币消费中占据主导地位,而 ChatGPT 和 Gemini 则被排除在前十名之外。

智普推出GLM 5.2,首席执行官与埃隆·马斯克就中国人工智能前沿时间表发生争执
中国人工智能实验室智普发布了 GLM 5.2,首席执行官唐杰推迟了埃隆·马斯克 (Elon Musk) 提出的 2027 年第一季度中国实现 Fable 级人工智能的时间表。
