模型目录

先确定要完成的任务,再选择合适的 AI 图片或视频模型。

每个模型页都会说明 ImageStyle 中当前可用的输入方式、输出控制和实用流程。明确需要的结果后进入对应模型页,并在生成前核对设置。

AI 图片模型

对比文字生图、参考图引导、画面比例和输出档位。

AI 图片模型

Nano Banana 2

适合参考图引导、可手动选择 1K、2K、4K 且画面比例丰富的图片任务。

查看模型详情
AI 图片模型

Nano Banana 2 Lite

适合参考图引导、画面比例丰富且输出档位由模型决定的图片方向。

查看模型详情
AI 图片模型

Nano Banana Pro

适合最多 8 张已授权参考图,并可手动选择 1K、2K、4K 的图片任务。

查看模型详情
AI 图片模型

Nano Banana

适合使用灵活画面比例、由模型决定输出档位的纯文字图片方向。

查看模型详情
Seedream 5 Pro logo
AI 图片模型

Seedream 5 Pro

适合聚焦的文字或参考图引导图片任务,可选择 1K 或 2K 输出。

查看模型详情
AI 图片模型

GPT Image 2

适合详细说明和参考图引导,并需权衡 1K、2K、4K 与画面比例的任务。

查看模型详情
Grok logo
AI 图片模型

Grok Imagine

适合文字或单张参考图引导,并可选择 Standard 或 High 模式的图片任务。

查看模型详情
Grok logo
AI 图片模型

Grok Imagine Image 2.0

适合纯文字生图,支持最多 5,000 字符的提示词和 5 种已公开画面比例。

查看模型详情
Z
AI 图片模型

Z Image

适合简洁文字生图、5 种固定画面比例和模型决定输出档位的任务。

查看模型详情
Qwen logo
AI 图片模型

Wan 2.7 Image

适合参考图引导、1K 或 2K 输出及 8 种固定画面比例的图片任务。

查看模型详情
Qwen logo
AI 图片模型

Wan 2.7 Image Pro

适合文字主导的 1K、2K、4K 图片输出;带参考图时不能选择 4K。

查看模型详情
Qwen logo
AI 图片模型

Qwen Image 3.0

适合文字生图和参考图编辑,可选择 1K 或 2K 输出及 8 种固定画面比例。

查看模型详情
Qwen logo
AI 图片模型

Qwen Image 3.0 Pro

适合需要更高保真度的文字生图和参考图编辑,可选择 1K 或 2K 输出。

查看模型详情

AI 视频模型

对比文字、图片、音频和运动参考引导的视频流程,以及时长、画面比例和输出选项。

AI 视频模型

Seedance 2 Mini

适合结合文字、媒体参考、生成音频和网页搜索的多模态短视频。

查看模型详情
AI 视频模型

Seedance 2 Fast

适合当前 Fast 命名、默认 15 秒片段的多模态视频工作流。

查看模型详情
AI 视频模型

Seedance 2

适合需要明确选择 480p 至 4K 输出的多模态视频任务。

查看模型详情
AI 视频模型

Seedance 2.5

适合较长的多模态视频,支持 480p 或 720p、首尾帧和媒体参考。

查看模型详情
AI 视频模型

HappyHorse 1.1

适合文字或一张起始图视频,并需要当前 9 种文字生视频画面比例的任务。

查看模型详情
AI 视频模型

HappyHorse

适合简洁的文字或单首帧流程,并使用 5 种标准画面比例。

查看模型详情
AI 视频模型

Kling 2.6

适合提示词主导的 5 或 10 秒视频,固定 720p 并支持生成音频。

查看模型详情
AI 视频模型

Kling V3 Turbo

适合提示词主导的文字或图片视频,支持 720p 或 1080p 以及 3 至 15 秒。

查看模型详情
AI 视频模型

Kling 3.0 Video

适合提示词主导的短序列,支持一张图片、多镜头、生成音频和质量档位。

查看模型详情
AI 视频模型

Kling O3

适合单镜头文字或有序首尾帧生视频,可选 720p 至 4K 输出和原生音频。

查看模型详情
AI 视频模型

Wan 2.6 Video

适合使用提示词改造上传源视频,可选择 5 或 10 秒、720p 或 1080p,并支持多镜头控制。

查看模型详情
AI 视频模型

Kling 2.6 Motion Control

适合由参考图和驱动视频控制动作,可选 720p 或 1080p,来源视频时长取决于角色方向。

查看模型详情
AI 视频模型

Kling 3.0 Motion Control

适合由参考图和驱动视频控制动作,可选 720p 或 1080p,来源视频时长取决于角色方向。

查看模型详情
AI 视频模型

Wan 2.7 Video

适合使用提示词、画面、运动片段、驱动音频和负面提示词引导的视频任务。

查看模型详情
AI 视频模型

Grok Imagine Video

适合文字或单图视频,支持 6 至 30 秒;图生视频时画面比例由来源图决定。

查看模型详情
AI 视频模型

Grok Imagine Video 1.5 Preview

适合 Preview 文字或多图视频工作流,支持 1 至 15 秒和自适应画面比例。

查看模型详情
AI 视频模型

Gemini Omni Video

适合长提示词主导、可选图片参考且时长固定为 4、6、8 或 10 秒的视频说明。

查看模型详情
AI 视频模型

MiniMax H3

适合文字、首尾帧或媒体参考生视频,支持 768P 或 2K 和 4 至 15 秒片段。

查看模型详情
AI 视频模型

Veo 3.1 Quality

适合当前 Quality 命名的文字或首尾帧工作流,时长为 4、6 或 8 秒。

查看模型详情
AI 视频模型

Veo 3.1 Fast

适合当前 Fast 命名的文字或首尾帧工作流,时长为 4、6 或 8 秒。

查看模型详情
AI 视频模型

Veo 3.1 Lite

适合当前 Lite 命名的文字或首尾帧工作流,时长为 4、6 或 8 秒。

查看模型详情
AI 视频模型

OmniHuman 1.5

适合把上传的人像图片和音频结合成视频。

查看模型详情

模型可用性和设置可能变化;提交前请以生成工作区显示的当前控制项为准。

能力来源: 当前 ImageStyle 模型配置。