Google 于 2026 年 7 月 21 日推出了三个新的 Gemini 模型,使开发人员大规模构建生产型 AI 代理所需的效率和成本效益加倍。该公司推出了 Gemini 3.6 Flash、Gemini 3.5 Flash-Lite 和 Gemini 3.5 Flash Cyber​​,分别针对竞争日益激烈的人工智能模型领域的不同细分市场。为了全面报道人工智能突发新闻 的最新进展,这些版本标志着 Google 为赢得成本敏感的开发者市场而采取的最积极的举措。

这一消息发布之际,这家搜索巨头正处于关键时刻。虽然 OpenAI 和 Anthropic 等竞争对手以其旗舰模型吸引了人们的注意,但 Google 的 Flash 系列已经开辟了一个利基市场,成为需要经济可靠地运行 AI 代理的开发人员的首选。新模型代表了代理工作流程的质量和效率的重大进步。

Gemini 3.6 Flash:新的主力型号

Gemini 3.6 Flash 被定位为 Google 的主力模型,直接基于使用先前 3.5 Flash 的开发人员的反馈而构建。根据谷歌产品管理高级总监 Tulsee Doshi 撰写的公告,该模型提供了改进的编码、知识工作和多模式性能,同时有意义地减少了代币消耗。

在人工分析指数上,Gemini 3.6 Flash 消耗的输出代币比其前身减少了 17%。在某些基准测试中,例如 Datacurve 的 DeepSWE,降低幅度高达 65%。该模型还需要更少的推理步骤和工具调用来完成多步骤工作流程。

定价为每百万个输入代币 1.50 美元,每百万个输出代币 7.50 美元,低于上一代。这使得大规模构建和运行代理更具成本效益,这是企业在数千个并发任务中部署人工智能的关键因素。

基准改进

Google 报告了与 3.5 Flash 相比的几个显着的性能提升:

  • DeepSWE: 49% 与 37%,反映出代码编辑的精度更高,不需要的编辑更少,执行循环也更少
  • MLE Bench: 63.9% 对比 49.7%,机器学习研究能力显着提升
  • OSWorld 验证: 83.0% 对比 78.4%,显示计算机使用能力有所提高
  • GDPval-AA v2: 1421 与 1349,反映了知识工作任务的收益

现在可以通过 Gemini API 和 Gemini Enterprise 作为内置客户端工具使用计算机,从而无需第三方编排层。

Gemini 3.5 Flash-Lite:专为速度和规模而打造

除了 Flash 升级之外,Google 还发布了 Gemini 3.5 Flash-Lite,专为低延迟任务和高吞吐量工作负载(如代理搜索和文档处理)而设计。它是 3.5 系列中最快的模型,根据人工分析的测量,以每秒 350 个输出令牌的速度运行。

Flash-Lite 的定价非常激进,每百万个输入代币为 0.30 美元,每百万个输出代币为 2.50 美元,为大规模运行生产流量的开发人员提供了令人信服的性价比。谷歌指出,在许多代理和编码评估中,该模型甚至优于更大的 Gemini 3 Flash,包括在 SWE-Bench Pro(54.2% 对 49.6%)和 OSWorld-Verified(74.0% 对 65.1%)上。

该模型支持可配置的思维水平,允许开发人员优先考虑大批量任务的低延迟执行,或为复杂的多步骤子代理工作负载提供更高的思维水平。

Gemini 3.5 Flash Cyber:人工智能实现代码安全

第三个版本 Gemini 3.5 Flash Cyber 是一个专门用于查找和修复网络安全漏洞的模型。它建立在 3.5 Flash 之上,与 Google 的 CodeMender 代理配合使用,后者使用多个 Flash Cyber​​ 代理协同工作来生成组合的安全报告。

在 Cyber​​Gym 基准测试中,该模型达到了前沿的竞争性能。然而,考虑到该技术的双重用途,谷歌在部署方面采取了谨慎的态度。作为有限访问试点计划的一部分,该模型将通过 CodeMender 专门向政府和值得信赖的合作伙伴开放。

这使得一线防御者能够在关键漏洞被利用之前先发现并修复这些漏洞,同时降低更广泛的滥用风险。

Gemini 3.5 Pro 仍在测试中

谷歌证实,备受关注的旗舰机型Gemini 3.5 Pro目前正在与合作伙伴进行测试,一旦准备就绪将立即广泛发布。由于内部绩效目标和一波研究人员离职潮,该公司此前推迟了 Pro 的发布。

也许最值得注意的是,谷歌透露,该团队已经开始了其所称的 Gemini 4 迄今为止最雄心勃勃的预训练,这表明下一代模型已经在进行中。

加强安全保障

Gemini 3.6 Flash 在化学、生物、放射和核 (CBRN) 威胁和网络攻击滥用领域提供了增强的前沿安全保障。谷歌表示,这些保护措施使该模型大大增强了对越狱的抵抗力,同时最大限度地减少了对有益用途的拒绝。

此次发布正值华盛顿对人工智能模型安全性的严格审查之际,特朗普政府敦促各公司在公开发布之前与政府测试人员分享未发布的模型。谷歌 DeepMind 和微软均于 2026 年 5 月与政府人工智能标准与创新中心签署协议,共享其国家安全测试的前沿模型。

可用性

Gemini 3.6 Flash 和 3.5 Flash-Lite 可通过 Gemini API、Google AI Studio 和 Android Studio 立即供开发人员使用。企业客户可以通过Gemini企业代理平台访问它们。 Gemini 应用程序还支持这两种模型供消费者使用,并且 3.5 Flash-Lite 正在 Google 搜索中推出。

保持人工智能领先地位

想从人工智能世界获得更多信息吗?为 AI BuzzWire 添加书签,获取值得信赖的最新人工智能行业报道。

阅读更多人工智能新闻 →