人工智能模型

53 articles

OpenAI开始向部分客户推出GPT-6 Astra,宣告AGI时代已经到来
人工智能模型

OpenAI开始向部分客户推出GPT-6 Astra,宣告AGI时代已经到来

OpenAI 已开始向部分网络安全客户推出 GPT-6 Astra,Greg Brockman 宣告了 AGI 时代的到来。以下是谁可以访问以及接下来会发生什么。

2026年9月4日1 min read
阿布扎比的 IFM 发布 K2 Horizo​​n:六种开放模型,具有完整的训练数据和代码
人工智能模型

阿布扎比的 IFM 发布 K2 Horizo​​n:六种开放模型,具有完整的训练数据和代码

IFM 推出了 K2 Horizo​​n:六个开放模型(0.9B 至 375B-A23B),在 Apache 2.0 下提供完整的训练数据、检查点、日志和代码。它包括什么。

2026年9月3日1 min read
Meta 推出 Muse Spark 1.3,并对 Muse 代码和 Meta 模型 API 进行代理升级
人工智能模型

Meta 推出 Muse Spark 1.3,并对 Muse 代码和 Meta 模型 API 进行代理升级

Meta 的 Muse Spark 1.3 推出了 Muse Code 和 Meta Model API,具有代理工作流程升级、更好的多任务处理和用于安全测试的最大推理。

2026年9月3日1 min read
谷歌推出 Gemini 3.8 Flash 和 Flash Cyber​​,这是六周内的第三个型号发布
人工智能模型

谷歌推出 Gemini 3.8 Flash 和 Flash Cyber​​,这是六周内的第三个型号发布

谷歌推出了 Gemini 3.8 Flash 和专注于网络安全的 Flash Cyber​​ 变体,声称其编码性能接近 Opus,而价格却仅为 Opus 的一小部分。

2026年9月2日2 min read
MultiverseComputing推出欧洲排名最高的人工智能模型Quasar 438B
人工智能模型

MultiverseComputing推出欧洲排名最高的人工智能模型Quasar 438B

MultiverseComputing推出了Quasar 438B,这是一款400B级推理模型,在人工智能分析智能指数上得分为43,是所有欧洲模型中得分最高的。

2026年9月2日1 min read
谷歌准备于周三发布 Gemini 3.8 Flash,以缩小人工智能编码差距
人工智能模型

谷歌准备于周三发布 Gemini 3.8 Flash,以缩小人工智能编码差距

据《华尔街日报》报道,谷歌 DeepMind 计划最快于周三推出 Gemini 3.8 Flash,内部测试显示 Gemini 在编码方面取得了进展,而 Gemini 已落后于竞争对手。

2026年9月2日1 min read
OpenAI 确认 Astra 是其第一个“关键”网络安全模型,并设置限制发布
人工智能模型

OpenAI 确认 Astra 是其第一个“关键”网络安全模型,并设置限制发布

OpenAI 确认其即将推出的 Astra 模型跨越了“关键”网络安全门槛,并将很快发布,但对其最强大的网络工具的访问受到限制。

2026年9月2日1 min read
Anthropic 推出 Claude Fable 5.1 和 Mythos 5.1:便宜 25%,代理编码能力更强
人工智能模型

Anthropic 推出 Claude Fable 5.1 和 Mythos 5.1:便宜 25%,代理编码能力更强

Anthropic 的 Claude Fable 5.1 将典型成本降低了 25%,并在代理编码基准上取得了巨大进步,而 Mythos 5.1 则面向可信访问用户。

2026年9月1日2 min read
Cohere 发布 Parse 5,这是一款专为成本优先摄取而构建的 2.3B 参数文档解析 AI
人工智能模型

Cohere 发布 Parse 5,这是一款专为成本优先摄取而构建的 2.3B 参数文档解析 AI

Cohere 的 Parse 5 使用 2.3B 参数模型将 PDF、幻灯片和扫描件转换为结构化 Markdown。问题是:它的基准领先优势取决于部分得分。

2026年8月30日1 min read
Z.ai 在 Hugging Face 上开放 GLM-5.3 权重,并获得针对超大规模企业的许可证
人工智能模型

Z.ai 在 Hugging Face 上开放 GLM-5.3 权重,并获得针对超大规模企业的许可证

Z.ai 在 Hugging Face 上发布了 GLM-5.3 权重,具有 1M 代币上下文和自定义许可证,需要对 100 亿美元以上的 MaaS 提供商进行安全审查。

2026年8月29日2 min read
腾讯开源 Hy4 预览:770B 参数 MoE,1M 代币上下文
人工智能模型

腾讯开源 Hy4 预览:770B 参数 MoE,1M 代币上下文

腾讯混元团队在 Apache 2.0 下发布了 Hy4 预览版,这是一个 770B 参数的 MoE 模型,具有 49B 活动参数、1M 代币上下文和第一天 vLLM 支持。

2026年8月28日1 min read
谷歌发布 Gemini 3.5 Transcribe 和 Omni 1.1 Flash:为 AI 开发者带来两项升级
人工智能模型

谷歌发布 Gemini 3.5 Transcribe 和 Omni 1.1 Flash:为 AI 开发者带来两项升级

谷歌的新 Gemini 3.5 Transcribe 的字错误率达到 2.6%,而 Omni 1.1 Flash 则增加了 40 秒视频场景、4K 升级和帧级控制。

2026年8月28日2 min read
Google 的 Gemini Omni 1.1 Flash 为 AI 视频添加工作室级控制和 4K 输出
人工智能模型

Google 的 Gemini Omni 1.1 Flash 为 AI 视频添加工作室级控制和 4K 输出

Google 发布了 Gemini Omni 1.1 Flash,具有长达 40 秒的场景扩展、开始和结束帧过渡以及通过 Gemini API 进行 4K 升级。

2026年8月27日1 min read
谷歌推出 Gemini 3.5 Transcribe:85 种语言实时语音识别
人工智能模型

谷歌推出 Gemini 3.5 Transcribe:85 种语言实时语音识别

谷歌推出了 Gemini 3.5 Transcribe,可检测 85 种语言,流媒体错误率降低 4%,响应速度比 Chirp 3 快 70%,并在其应用程序中推广。

2026年8月27日1 min read
阿里巴巴的Qwen3.8-Flash-Next预览Qwen4架构,具有6B活动参数
人工智能模型

阿里巴巴的Qwen3.8-Flash-Next预览Qwen4架构,具有6B活动参数

阿里巴巴的 Qwen3.8-Flash-Next 预览了 Qwen4:125B 参数,6B 主动、开放权重,以九分之一的训练成本获得击败 Qwen3.7-Plus 的结果。

2026年8月26日1 min read
Z.ai 在 MIT 许可下推出 GLM-5.3-Flash:Ox Alpha 揭晓,权重实时发布
人工智能模型

Z.ai 在 MIT 许可下推出 GLM-5.3-Flash:Ox Alpha 揭晓,权重实时发布

Z.ai 的 GLM-5.3-Flash 是一款 320B-A18B MIT 许可的多模态模型,采用中国人工智能芯片,目前以低成本在人工分析排名中名列前茅。

2026年8月26日1 min read
Z.ai 确认 Ox Alpha 是 GLM 系列模型并将发布其重量
人工智能模型

Z.ai 确认 Ox Alpha 是 GLM 系列模型并将发布其重量

Z.ai 告诉彭博社,病毒式隐形模型 Ox Alpha 是 GLM 系列的新版本,公开重量今晚到货,结束了一周的狂热猜测。

2026年8月26日1 min read
Ox Alpha的制造者可能已被揭露:分析指向Zhipu的GLM
人工智能模型

Ox Alpha的制造者可能已被揭露:分析指向Zhipu的GLM

提示注入技巧和 gzip 压缩分析表明 OpenRouter 的神秘模型 Ox Alpha 是 Zhipu 的 GLM - 但怀疑者反驳道。

2026年8月25日1 min read
DeepSeek 通过实验性图像模型为 V4-Flash 添加视觉功能
人工智能模型

DeepSeek 通过实验性图像模型为 V4-Flash 添加视觉功能

DeepSeek 推出了带有图像输入、1M 代币上下文和 Flash 级定价的 deepseek-v4-flash-vision-exp,修复了其模型最臭名昭著的盲点。

2026年8月22日1 min read
价格战达到旗舰阶段,OpenAI 将 GPT-5.6 Sol API 定价下调 20% 以上
人工智能模型

价格战达到旗舰阶段,OpenAI 将 GPT-5.6 Sol API 定价下调 20% 以上

OpenAI 将 GPT-5.6 Sol 开发者定价降低了 20% 以上,将产出代币降至每百万 20 美元。此举结束了数月来维持旗舰价格的局面。

2026年8月22日2 min read
Ox Alpha:OpenRouter 具有 100 万代币上下文的免费隐形 AI 模型引发了一场侦探小说
人工智能模型

Ox Alpha:OpenRouter 具有 100 万代币上下文的免费隐形 AI 模型引发了一场侦探小说

一个名为 Ox Alpha 的免费隐形前沿模型出现在 OpenRouter 上,具有 1M 代币上下文和视频输入,人工智能社区正在竞相揭开其制造者的面纱。

2026年8月21日1 min read
谷歌 Gemma 开放模型下载量突破 10 亿次,成为社区变体前 10 万名
人工智能模型

谷歌 Gemma 开放模型下载量突破 10 亿次,成为社区变体前 10 万名

谷歌表示,其 Gemma 开放模型的下载量已超过 10 亿次,拥有 10 万多个社区变体、与 NASA 进行轨道部署以及新的 Awesome Gemma 中心。

2026年8月21日1 min read
Ornith-1.5 在代理编码基准上与 Claude Opus 4.8 相匹配,具有完全开放、自我改进的模型
人工智能模型

Ornith-1.5 在代理编码基准上与 Claude Opus 4.8 相匹配,具有完全开放、自我改进的模型

麻省理工学院许可的 Ornith-1.5 系列生成自己的训练任务和支架,其 397B 旗舰产品将 Claude Opus 4.8 与 Terminal-Bench 2.1 编码联系起来。

2026年8月20日1 min read
阿里巴巴的 Qwen 3.8 27B 在笔记本电脑上运行并扩展了自己的更大型号
人工智能模型

阿里巴巴的 Qwen 3.8 27B 在笔记本电脑上运行并扩展了自己的更大型号

阿里巴巴的 Qwen 3.8 27B 是一个 Apache-2.0 视觉模型,可以在笔记本电脑上运行,并且击败了封闭的 Qwen 3.7-Plus,但其默认推理设置超出了一切。

2026年8月17日1 min read
阿里巴巴Qwen人工智能模型下载量突破30亿,超越Meta和谷歌
人工智能模型

阿里巴巴Qwen人工智能模型下载量突破30亿,超越Meta和谷歌

在 Qwen 3.8 开放权重发布几周后,阿里巴巴的 Qwen 模型下载量突破了 30 亿次,在开源人工智能采用率方面超越了 Meta 和谷歌。

2026年8月15日1 min read
Z.ai 的 GLM-5.3 加倍编码,并呈现出惊人的网络安全技能
人工智能模型

Z.ai 的 GLM-5.3 加倍编码,并呈现出惊人的网络安全技能

Z.ai 的新 GLM-5.3 带来了显着的编码收益和最先进的漏洞发现,缩小了 Anthropic 和 OpenAI 与开放权重前沿的差距。

2026年8月14日1 min read
Google 推出 Gemini 3.7 Flash:迄今为止最智能的编码和代理工具,价格仅为一半
人工智能模型

Google 推出 Gemini 3.7 Flash:迄今为止最智能的编码和代理工具,价格仅为一半

Google 的 Gemini 3.7 Flash 在 3.6 Flash 之后仅三周就上市了,在编码和代理方面取得了重大进展,而且入门价格仅为其前身的一半。

2026年8月13日1 min read
DeepSeek 推出 V4 Pro 全面上市、开源 Harness Agent 并提高 API 价格
人工智能模型

DeepSeek 推出 V4 Pro 全面上市、开源 Harness Agent 并提高 API 价格

中国人工智能实验室 DeepSeek 发布了 V4 Pro 预览版,推出 Harness v0.1 作为 Claude Code 的开源竞争对手,并在 IPO 前大幅提高 API 定价。

2026年8月13日2 min read
xAI 推出 Grok 4.6,与前沿情报指数上的 GPT-5.6 Sol 相匹配
人工智能模型

xAI 推出 Grok 4.6,与前沿情报指数上的 GPT-5.6 Sol 相匹配

xAI 的 Grok 4.6 在人工智能分析智能指数上得分为 61,与 GPT-5.6 Sol 并列,具有出色的代理性能,但成本降低了 60%。现已在 Cursor 和 Grok Build 中提供。

2026年8月12日2 min read
Google DeepMind 的 SL2T 为 Pixel 11 手机带来手语翻译
人工智能模型

Google DeepMind 的 SL2T 为 Pixel 11 手机带来手语翻译

谷歌 DeepMind 推出了 SL2T,这是一种手语翻译模型,可以从 Pixel 11 Pro Fold 开始,在 Pixel 11 系列上将手语转换为文本。

2026年8月12日1 min read
Nvidia 打造 1 万亿参数 Nemotron 4 挑战顶级开源 AI 模型
人工智能模型

Nvidia 打造 1 万亿参数 Nemotron 4 挑战顶级开源 AI 模型

Nvidia 正在开发 Nemotron 4,这是一种具有至少一万亿个参数的开源人工智能模型,可与领先的开放权重系统相媲美。该模型可能会在今年秋天上市。

2026年8月12日1 min read
NVIDIA 推出 Nemotron 3.5 Lightning 和 NeMo Switchyard 以实现更智能的代理 AI
人工智能模型

NVIDIA 推出 Nemotron 3.5 Lightning 和 NeMo Switchyard 以实现更智能的代理 AI

NVIDIA 全新的 300 亿参数开放模型和开源路由库有望将跨边缘设备、PC 和云的输出速度提高 4 倍,并将代理任务速度提高 30%。

2026年8月11日1 min read
马克·扎克伯格在《超级智能宣言》中向封闭的人工智能竞争对手宣战,Meta 开源了其最强大的模型
人工智能模型

马克·扎克伯格在《超级智能宣言》中向封闭的人工智能竞争对手宣战,Meta 开源了其最强大的模型

Meta 的马克·扎克伯格发表了一份全面的宣言,呼吁为所有人提供超级人工智能,攻击封闭的人工智能竞争对手,并发布 Meta 最强大模型的开放版本。

2026年8月11日1 min read
Meta 发布 Muse Glimmer,这是一款在消费级 GPU 上运行 AI 代理的 30B 开放权重模型
人工智能模型

Meta 发布 Muse Glimmer,这是一款在消费级 GPU 上运行 AI 代理的 30B 开放权重模型

Meta 发布了 Muse Glimmer,这是一个 Apache 2.0 下的 300 亿参数开放模型,在本地运行时在代理基准测试中的性能优于 Gemma4-31B 和 Qwen3.6-27B。

2026年8月10日2 min read
OpenAI 在评估标记“关键”网络安全功能后暂停 Astra 模型
人工智能模型

OpenAI 在评估标记“关键”网络安全功能后暂停 Astra 模型

OpenAI 已暂停其即将推出的 Astra 模型的开发,因为测试显示该模型可能达到“关键”网络安全阈值——第一个触发最高风险级别的模型。

2026年8月10日1 min read
据报道,字节跳动正在训练 10 万亿参数的人工智能模型,以对抗 Anthropic 的神话
人工智能模型

据报道,字节跳动正在训练 10 万亿参数的人工智能模型,以对抗 Anthropic 的神话

据《金融时报》报道,字节跳动正在构建一个包含 10 万亿参数的大型模型,旨在与 Anthropic 神话的规模相匹配,从而加剧中美人工智能竞赛。

2026年8月9日1 min read
由于严重的网络安全问题,OpenAI 暂停了新 Astra 模型的开发工作
人工智能模型

由于严重的网络安全问题,OpenAI 暂停了新 Astra 模型的开发工作

在内部测试显示关键级别的网络功能后,OpenAI 放慢了即将推出的 Astra 模型的开发速度,并在发布前加强了控制。

2026年8月9日1 min read
xAI 的 Imagine Image 2.0 在 Arena 基准测试中仅落后于 OpenAI 的 GPT-Image-2
人工智能模型

xAI 的 Imagine Image 2.0 在 Arena 基准测试中仅落后于 OpenAI 的 GPT-Image-2

xAI 发布了适用于 Grok 的 Imagine Image 2.0,在 Arena 基准测试中排名全球第二,仅次于 OpenAI 的 GPT-Image-2,具有新的编辑工具、多参考支持和预配置模板。

2026年8月8日1 min read
OpenAI 在 Astra 模型达到“关键”网络安全风险阈值后暂停其开发
人工智能模型

OpenAI 在 Astra 模型达到“关键”网络安全风险阈值后暂停其开发

在内部测试发现 Astra 可能达到其准备框架中的最高网络安全风险级别后,OpenAI 停止了 Astra 的部分开发,这是其第一个达到此标准的模型。

2026年8月8日1 min read
字节跳动正在训练一个 10 万亿参数的人工智能模型来对抗 Anthropic 的神话
人工智能模型

字节跳动正在训练一个 10 万亿参数的人工智能模型来对抗 Anthropic 的神话

字节跳动正在训练一个参数高达 10 万亿个的巨型人工智能模型,接近 Anthropic 的 Mythos 5 的估计规模,让中国现任领导人相形见绌。

2026年8月7日1 min read
Mistral 的 Shieldstral:3B 开放式重量安全模型,可以阅读策略而不是记住策略
人工智能模型

Mistral 的 Shieldstral:3B 开放式重量安全模型,可以阅读策略而不是记住策略

Mistral AI 发布了 Shieldstral,这是一个 3B 参数开放权重安全分类器,可在推理时根据简单语言审核策略评估文本和图像。

2026年8月5日1 min read
阿里巴巴推出Qwen3.8-Max:2.4万亿参数模型,堪比Anthropic的Claude
人工智能模型

阿里巴巴推出Qwen3.8-Max:2.4万亿参数模型,堪比Anthropic的Claude

阿里巴巴发布了 Qwen3.8-Max,这是一个 2.4 万亿参数的模型,在基准测试中仅落后于 Anthropic 的 Claude,并承诺在几天内开放权重。

2026年8月3日1 min read
OpenAI 的 Astra 模型通过机器检查证明解决了 10 个长期未解决的数学问题
人工智能模型

OpenAI 的 Astra 模型通过机器检查证明解决了 10 个长期未解决的数学问题

OpenAI 未发布的 Astra 模型通过精益验证的证明解决了数学和计算机科学中的 10 个开放问题,在美国政府审查之前预告了其下一个主要模型。

2026年8月3日1 min read
谷歌即将发布 Gemini 3.5 Pro 亮相 LM Arena 盲测
人工智能模型

谷歌即将发布 Gemini 3.5 Pro 亮相 LM Arena 盲测

谷歌推迟发布的 Gemini 3.5 Pro 在 LMSYS Chatbot Arena 盲测中多次被发现,这表明公开发布可能终于迫在眉睫。

2026年8月2日1 min read
Thinking Machines 发布 Inkling-Small:276B 开放式重量型号,尺寸仅为旗舰产品的四分之一
人工智能模型

Thinking Machines 发布 Inkling-Small:276B 开放式重量型号,尺寸仅为旗舰产品的四分之一

Thinking Machines Lab 发布了 Inkling-Small,这是一个具有 2760 亿参数的开放重量级模型,具有 12B 活性,其大小与其旗舰产品(开放重量竞赛中的美国参赛者)的四分之一相匹配。

2026年8月2日1 min read
随着中国人工智能价格战升级,DeepSeek 推出 V4-Flash 公测版
人工智能模型

随着中国人工智能价格战升级,DeepSeek 推出 V4-Flash 公测版

DeepSeek 发布了官方 V4-Flash beta API,其经过重新训练的模型在九项代理基准测试中击败了自己的旗舰产品 V4 Pro,同时在价格上低于美国竞争对手。

2026年8月1日1 min read
随着企业对人工智能成本越来越敏感,OpenAI 将 GPT-5.6 模型价格下调高达 80%
人工智能模型

随着企业对人工智能成本越来越敏感,OpenAI 将 GPT-5.6 模型价格下调高达 80%

随着企业审查人工智能支出,OpenAI 降低了包括 Luna 在内的两种 GPT-5.6 模型的价格,将较小模型的成本降低了 80%。

2026年8月1日1 min read
DeepSeek 的新型 V4-Flash 型号与 GPT-5.6 Luna 相匹配,成本低 60%
人工智能模型

DeepSeek 的新型 V4-Flash 型号与 GPT-5.6 Luna 相匹配,成本低 60%

DeepSeek 发布了 V4-Flash“0731”,这是一种开放权重模型,在基准测试中几乎与 OpenAI 的 GPT-5.6 Luna 持平,而成本却低了约 60%。

2026年7月31日1 min read
中国 MiniMax 发布 H3 AI 视频模型,具有 2K 剪辑、立体声和开放权重
人工智能模型

中国 MiniMax 发布 H3 AI 视频模型,具有 2K 剪辑、立体声和开放权重

中国人工智能初创公司 MiniMax 于 2026 年 7 月 31 日推出了 H3 视频生成模型,以竞争对手价格的一小部分提供 2K 分辨率、立体声音频和开放权重,直接挑战字节跳动的 Seedance 2.5。

2026年7月31日1 min read
谷歌 DeepMind 推出具有全身人形控制和多机器人协作功能的 Gemini Robotics 2
人工智能模型

谷歌 DeepMind 推出具有全身人形控制和多机器人协作功能的 Gemini Robotics 2

谷歌 DeepMind 推出了 Gemini Robotics 2,这是一种视觉-语言-动作模型,使人形机器人能够在整个身体上移动、抓取和协调任务。

2026年7月31日1 min read
随着公司重新考虑人工智能成本,OpenAI 将 GPT-5.6 API 价格下调高达 80%
人工智能模型

随着公司重新考虑人工智能成本,OpenAI 将 GPT-5.6 API 价格下调高达 80%

OpenAI 于 2026 年 7 月 30 日将 GPT-5.6 Luna 和 Terra API 的价格下调了 80%,随着企业审查推理支出,从而削弱了 Anthropic 的价格。

2026年7月30日2 min read
OpenAI 表示 GPT-5.6 Sol 在 ARC-AGI-3 上击败了 Claude Opus 5 — 但仅限于其自己的设置
人工智能模型

OpenAI 表示 GPT-5.6 Sol 在 ARC-AGI-3 上击败了 Claude Opus 5 — 但仅限于其自己的设置

OpenAI 报告称,GPT-5.6 Sol 在使用保留推理和压缩的 ARC-AGI-3 上得分为 38.3%,超过了 Claude Opus 5。但官方的测试却讲述了一个不同的故事,引发了关于基准公平性的争论。

2026年7月30日1 min read
Black Forest Labs 推出 FLUX 3:适用于图像、视频、音频和机器人的单一 AI 模型
人工智能模型

Black Forest Labs 推出 FLUX 3:适用于图像、视频、音频和机器人的单一 AI 模型

Black Forest Labs 推出了 FLUX 3,这是一种多模态模型,可联合生成图像、视频与本地音频以及机器人动作预测,在 77% 的比较中优于 Runway Gen-4.5。

2026年7月26日1 min read