文字生图与图片编辑
从空白提示词开始生成,或上传图片作为编辑、重混、产品组合、截图重设计和风格迁移的参考上下文。
通过精准提示词控制、多图参考、清晰文字排版和灵活输出设置来创建、编辑并理解图像。

GPT Image 2 将文字生图、图生图和图片编辑整合进一个以提示词为核心的工作空间。想要大范围动漫创作时用 AI Image Generator,当精确文字渲染、截图理解和多图参考更重要时,选择 GPT Image 2。
model workspace
GPT Image 2


GPT Image 2 是一个强大的图像生成模型,能够理解视觉上下文、遵循详细指令,并在图片中渲染可读文字。本页面将该模型封装为 Kusa 工具,支持图片上传、提示词控制、比例设置、输出数量和像素级选项。

许多图像任务都以现有素材为起点:一张截图、一块参考板、一张产品照片,或是一个粗略构图。GPT Image 2 能对这些输入进行推理,而 Prompt Inspector、History 和 Kusa 生成工具则帮助你在保留精确创作意图的同时持续迭代。

传统编辑流程往往要在普通 AI Image Generator、设计编辑器之间来回切换,还要反复手动修复拼错的文字或误解的参考。GPT Image 2 专为更严格的指令遵循而生,让提示词、上传图片和最终版式保持连贯。

从纯文字开始,上传参考图,控制画布,并将输出结果方便地复用于后续创作流程。
从空白提示词开始生成,或上传图片作为编辑、重混、产品组合、截图重设计和风格迁移的参考上下文。
当任务涉及人物一致性、版式、产品细节、UI 截图或多张视觉参考时,可上传多张图片。History 会保留已完成的结果以便复用。
当提示词中包含可读标题、标签、UI 文案、海报或包装文字时,GPT Image 2 尤为出色。Prompt Inspector 可在渲染前帮助精炼措辞。
按需添加参考图,编写提示词,选择输出设置,然后生成并从 History 中复用结果。

纯文字生图无需上传,单图编辑上传一张,需要 GPT Image 2 对比多个参考时上传多张。
在提交任务前,选择画布形状、图片数量,以及低、中或高像素设置。

查看结果,下载最佳图片,从 History 中重新打开相同参数,或需要动态效果时将素材延伸至 Image to Video。

创作虚构包装、营销海报、社交封面及标题突出的图片,可读文字至关重要。

上传界面或原型截图,让 GPT Image 2 优化层级结构、间距和视觉呈现。

使用多张参考图保持人物、风格、产品细节或构图的一致性。当角色级别的改动更加具体时,OC Editor 是很好的后续工具。