xAI

Grok Imagine

Grok Imagine 是 xAI 的图像生成与编辑模型,支持 5 种宽高比、主参考图编辑以及文字生成图像和图像编辑两种模式,属于轻量档位。

Grok Imagine 是 xAI 进入图像生成领域的产品,体现了该公司的 AI 理念:能力强、灵活且限制更少。该模型以统一模式运行——仅给提示词时自动执行文字生成图像,提供参考图像时切换到图像编辑。它接受最多 10 张参考图像(后端处理主要图像用于编辑),支持 5 种宽高比(3:2、2:3、1:1、9:16、16:9),每次生成输出一张图像。该模型在写实、艺术和风格化美学方面都能产生可靠的通用结果。Grok Imagine 的突出之处在于内容灵活性——它处理的创意提示词范围比安全过滤更严格的模型更广,适用于讽刺、社论插画和非常规创意概念。作为轻量档位模型,它与 Kling Omni Image 并列 Astorie 上迭代最快的选择之一。它还与 Grok 视频模型配合形成完整的 xAI 驱动流程:用 Grok Imagine 生成静帧,然后将其动画化为 6 秒或 10 秒的视频片段。

Illustrative sample of xAI Grok Imagine on the Astorie canvas — a bold, unconventional editorial-illustration concept reflecting its flexible creative range
示意样图——代表性输出,非模型逐字渲染结果。

支持的功能

文本生成图像
图像到图像
图像编辑
参考图像
多图输入
标签

最适合

  • 限制更少的创意和非常规图像概念
  • 轻量档位探索,迭代速度快
  • 社论插画、讽刺和幽默驱动的视觉
  • 使用参考照片的快速图像编辑
  • xAI 流程:Grok Imagine 静帧 → Grok 视频动画

优势

  • 最广泛的内容灵活性——处理更严格模型可能拒绝的创意提示词
  • 轻量档位模型——Astorie 上迭代最快的选择之一
  • 统一模式:根据输入自动切换生成和编辑
  • 主参考图编辑,适合从单一锚点图像快速变换
  • 与 Grok 视频模型的直接流程,可生成 6 秒与 10 秒片段

局限性

  • 每次生成一张图像——无批量模式(需要批量时使用 Kling)
  • 输出分辨率不可配置——无 2K/4K 级别选项
  • 较新模型,社区知识较少且可用的提示词指南较少
  • 编辑模式仅使用第一张参考图像,即使提供了多张

使用技巧

Grok Imagine 在具体生动的提示词中表现出色——"一只穿西装的浣熊在做 TED 演讲,写实风格"比"搞笑动物图片"效果好得多。
作为快速草稿工具:轻量档位下可大量生成变体,挑出最佳概念后再交给高端模型出最终图。
xAI 视频流程:用 Grok Imagine 生成主静帧,然后连接到 Grok 视频节点生成 6 秒或 10 秒动画。
编辑模式通过提供参考图像和描述变化来工作——"改成夜间"、"添加雨"、"将服装换成红色连衣裙"。
用相同提示词比较 Grok 和 FLUX 或 Imagen 的输出——不同模型擅长不同美学,轻量档位让 A/B 测试更快捷。

Astorie 上使用 Grok Imagine

Astorie 的无限画布上将 Grok Imagine 与其他 AI 模型连接使用。无需 GPU,免费开始。

免费开始

常见问题

Grok Imagine 在 Astorie 上属于什么档位?

Grok Imagine 属于 Astorie 的轻量档位——与 Kling Omni Image 并列迭代最快的图像模型之一。Grok 视频模型也可用于 6 秒和 10 秒片段。

Grok Imagine 可以编辑现有图像吗?

是的。Grok Imagine 以统一模式运行——仅提供提示词进行文字生成图像,或包含参考图像后模型切换到编辑模式。描述更改如"改成夜间"或"添加雨"来修改参考图像。

Grok Imagine 和其他图像模型有什么不同?

Grok Imagine 在 Astorie 上拥有最广泛的内容灵活性——它处理的创意提示词范围比安全过滤更严格的模型更广。这使其适用于讽刺、社论插画和非常规创意概念。

相关图像模型

返回所有图像模型