Elon Musk 的 xAI 发布了 Imagine Image 2.0,这是一款新的图像生成器,现在可以在 grok.com/imagine 以及 Grok 的 iOS 和 Android 应用程序中作为“质量模式”使用。 xAI 于 2026 年 8 月 8 日宣布推出,使 xAI 与 OpenAI 和拥挤的图像模型领域展开直接竞争,而且根据独立基准测试,它已经紧追领先者。有关模型发布和基准测试的最新信息,请关注我们的突发人工智能新闻

两个竞技场类别的第二名

截至 2026 年 8 月 7 日的Arena 排行榜中,Imagine Image 2.0 的更快“低”变体在平台跟踪的两个图像类别中均占据全球第二位。在 图像编辑竞技场,它的 Elo 评级为 1,439,落后于 OpenAI 的 GPT-Image-21,463。在 文本到图像领域,它达到 1,320,再次落后于 GPT-Image-2 的 1,380

差距虽小但始终如一。在 xAI 和 OpenAI 之下,排行榜上挤满了强有力的竞争者:Reve 2.1、Meta 的 Muse-Image、阿里巴巴的 Qwen-Image-3.0-Pro、谷歌的 Gemini 和字节跳动的 SeedDream 排名都进一步下降。 xAI 指出,新型号在相同测试中也大幅击败了其前身的“质量”变体,这表明了重大的代际飞跃。

为精确而打造,而不仅仅是漂亮的图片

根据 xAI 的说法,Imagine Image 2.0 旨在以细粒度的精度遵循指令,在复杂的视觉效果中保持版式和布局整洁,并在多代之间保持视觉一致性。这些目标针对创意和商业工作流程的实际需求,其中产生引人注目的图像但破坏文本覆盖或忽略特定构图指令的模型的用途有限。

指令遵循和排版已成为图像生成的关键战场。对于设计师、营销人员和产品团队来说,能够可靠地呈现可读文本、尊重宽高比并遵守详细提示的模型比那些仅仅产生美观但不可预测的输出的模型更有价值。 xAI 将 Imagine 2.0 直接定位在该可靠性层中。

一套编辑工具

除了原始生成之外,Imagine Image 2.0 还附带了一系列针对实际创意工作的编辑功能:

  • 魔棒仅修改图像的选定区域,允许进行有针对性的编辑,而无需重新生成整个图片。
  • 分割功能允许用户选择精确的区域进行编辑,背景删除工具导出具有透明背景的主题。
  • 多参考编辑 将最多 五个输入图像 组合到一个生成中,对于混合参考或维护跨变体的角色非常有用。
  • 智能调整大小 将现有图像转换为任何纵横比,模型自行填充额外的空间。

这些工具反映了更广泛的行业转变,从一次性生成到迭代、可控编辑——这是专业创意人员日常实际使用的工作流程。

模板和视频之路

xAI 还添加了模板,将常见的图像工作流程捆绑到预先配置的起点中。类别涵盖照片编辑、产品摄影、营销材料、设计工具、游戏资产和流媒体表情符号。通过为用户提供专门构建的预设,xAI 降低了非专家快速制作精美的品牌视觉效果的障碍。

也许最具前瞻性的功能是单独生成角色、位置和道具,同时保持所有图像的视觉风格一致。 xAI 将这种一致性功能定位为实现完整视频制作工作流程的垫脚石,这暗示该公司并不将图像生成视为终点,而是将其视为更丰富媒体的基础。

竞争风险

图像生成市场已成为人工智能领域竞争最激烈的领域之一。 OpenAI 目前占据榜首,但第一名和第二名之间的距离现在以数十个 Elo 点来衡量,而不是数百个。随着 Meta、阿里巴巴、谷歌和字节跳动都推出了竞争模型,xAI 缩小了差距,没有任何一家提供商能够持久锁定该类别。

特别是对于 Grok 来说,强大的图像模型加深了其作为一体化消费人工智能产品的吸引力。 xAI 表示,Imagine Image 2.0 的 API 访问“即将推出”,这将为开发者和企业开放该模型,此举可能会加速 Grok 自己的应用程序生态系统之外的采用,并进入第三方创意工具。

看什么

竞技场排名只是一个快照,随着提供商的迭代,图像基准可能会迅速变化。 Imagine Image 2.0 的真正考验将是其对精确性、编辑和一致性的强调是否会转化为推动重复使用的创意专业人士的持续采用,以及 xAI 是否可以将其势头从静态图像扩展到它已经正在传送的视频工作流程。

保持人工智能领先地位

图像生成竞赛正在快速发展,每周都会有新的模型和功能落地。如需有关模型发布、工具和竞争定义该领域的公司的清晰、基准驱动的报告,请为我们的主页添加书签并阅读更多人工智能新闻 →,网址为 https://aibuzzwire.news