AI 图片模型
Grok Imagine Image 2.0 AI 图片生成器
当图片可以完全用文字说明,并且当前 5 种画面比例之一适合目标位置时,可选择 Grok Imagine Image 2.0。
Grok Imagine Image 2.0 任务方向
这些本地参考用于把 Grok Imagine Image 2.0 当前的输入和控制项转化为具体任务方向,不作为该模型的生成结果展示。
每张卡都会标明它是已核验的模型系列示例,还是视觉参考。视觉参考不代表模型基准,也不构成前后效果声明。
- 输入要求
- 仅文字提示词
- 当前设置
- 提示词长度: 最多 5,000 个字符 · 输出分辨率: 1K · 画面比例: 5 种可选画面比例
- 选型边界
- 当前 ImageStyle 集成仅开放文字生图,因为 KIE 当前市场页没有公布图片编辑价格。现有图片必须参与引导时,请选择支持参考图的模型。

主体与场景
用一个明确主体和场景,判断文字说明是否建立了正确的视觉起点。
- 任务方向
- 用一个明确主体和场景,判断文字说明是否建立了正确的视觉起点。
视觉参考,不作为该模型输出
ImageStyle 本地视觉参考,不作为特定模型的生成结果展示。

构图方向
用明确画面和层级,判断提示词或参考图必须保留什么。
- 任务方向
- 用明确画面和层级,判断提示词或参考图必须保留什么。
视觉参考,不作为该模型输出
ImageStyle 本地视觉参考,不作为特定模型的生成结果展示。

细节与材质线索
说明应引导结果的可见细节,而不是把参考内容当成性能测试。
- 任务方向
- 说明应引导结果的可见细节,而不是把参考内容当成性能测试。
视觉参考,不作为该模型输出
ImageStyle 本地视觉参考,不作为特定模型的生成结果展示。
- 生成内容
- AI 图片
- 输入方式
- 仅文字提示词
- 输出分辨率
- 1K
与相近模型对比当前可用设置
先看输入、输出和画面控制是否匹配任务,再进入对应工作区生成。此表不把示例素材当作跨模型性能测试。
Grok Imagine Image 2.0
当前页面
适合纯文字生图,支持最多 5,000 字符的提示词和 5 种已公开画面比例。
- 输入方式
- 仅文字提示词
- 提示词长度
- 最多 5,000 个字符
- 输出分辨率
- 1K
Grok Imagine
适合文字或单张参考图引导,并可选择 Standard 或 High 模式的图片任务。
- 输入方式
- 文字提示词 + 最多 1 张参考图
- 提示词长度
- 最多 5,000 个字符
- 输出方式
- 由模型决定(无手动分辨率选择)
Nano Banana 2
适合参考图引导、可手动选择 1K、2K、4K 且画面比例丰富的图片任务。
- 输入方式
- 文字提示词 + 最多 5 张参考图
- 提示词长度
- 最多 20,000 个字符
- 输出分辨率
- 1K / 2K / 4K
Nano Banana 2 Lite
适合参考图引导、画面比例丰富且输出档位由模型决定的图片方向。
- 输入方式
- 文字提示词 + 最多 5 张参考图
- 提示词长度
- 最多 20,000 个字符
- 输出方式
- 由模型决定(无手动分辨率选择)
Grok Imagine Image 2.0 可以帮助你控制什么
从一份文字图片说明开始
当前端点要求 1 至 5,000 字符的提示词,并只发送所选画面比例。
从文字描述开始
这个模型当前从文字描述开始,不显示参考图输入。
选择可用输出设置
当前支持 1K,并提供5 种可选画面比例。生成前请以工作区显示的可选项为准。
Grok Imagine Image 2.0 当前设置
以下内容来自当前 ImageStyle 模型配置,用于帮助你在开始前判断是否匹配任务。
| 设置 | 当前可用内容 |
|---|---|
| 输入方式 | 仅文字提示词 |
| 提示词长度 | 最多 5,000 个字符 |
| 输出分辨率 | 1K |
| 画面比例 | 5 种可选画面比例 |
AI 图片模型
何时选择 Grok Imagine Image 2.0
适合纯文字生图,支持最多 5,000 字符的提示词和 5 种已公开画面比例。
当前工作流适配点
当图片可以完全用文字说明,并且当前 5 种画面比例之一适合目标位置时,可选择 Grok Imagine Image 2.0。
需要比较其他模型时
当前 ImageStyle 集成仅开放文字生图,因为 KIE 当前市场页没有公布图片编辑价格。现有图片必须参与引导时,请选择支持参考图的模型。
如何使用 Grok Imagine Image 2.0 生成图片
先写完整的视觉说明,再按目标位置选择 1:1、2:3、3:2、16:9 或 9:16。
- 1
先描述可见结果,再选择画面比例
写明主体、场景、构图和必须保留的细节,再选择目标画面比例。
- 2
确认文字方向
检查文字描述是否已经包含构图和最重要的视觉优先级。
- 3
选择输出控制
从当前的 1K 和5 种可选画面比例中选择适合用途的结果。
- 4
生成后检查
在公开使用前检查画面中的文字、商品细节、人物、标识和构图。
开始前与发布前的检查
- 设置以工作区为准
- 模型可用性和设置会变化;提交前请以当前工作区显示的选项为准。
- 只使用已授权素材
- 上传参考图时,请确认你有权在当前项目中使用和发布它。
- 人工核对成图
- 发布前仍应人工检查必须准确的可见文字、商品信息和品牌元素。
Grok Imagine Image 2.0 常见问题
- ImageStyle 中的 Grok Imagine Image 2.0 接收什么输入?
- 当前集成使用 grok-imagine-image-2-0/text-to-image 端点,需要最多 5,000 字符的提示词,并提供 5 种画面比例。
- Grok Imagine Image 2.0 可以上传参考图吗?
- 当前 ImageStyle 集成不可以;图片编辑会等公开价格核实后再评估。
- Grok Imagine Image 2.0 可以使用参考图吗?
- 当前不支持参考图输入;请从文字提示词开始。
- Grok Imagine Image 2.0 支持哪些输出设置?
- 当前支持 1K,并提供5 种可选画面比例。具体可选项以生成工作区为准。
- 使用 Grok Imagine Image 2.0 前要准备什么?
- 准备一段明确的视觉描述;如果当前模型支持参考图,只在有助于保留视觉起点时再加入已授权图片。
- 生成结果可以直接发布吗?
- 不建议直接发布。公开使用前,请人工检查文字、商品细节、人物、标识和其他必须准确的元素。
更新日期:
能力来源: 当前 ImageStyle 图片模型配置。