All models

gpt-image-1.5

OpenAIImage
0.55 Credits
Get your API key
gpt-image-1.5

兼顾精确改图与文字排版的图像创作模型

GPT Image 1.5 是 OpenAI 的图像生成与编辑模型,既能依据文字创作新画面,也能围绕已有图片做定向修改。它尤其适合需要保留人物外貌、产品特征、品牌标识和原始构图的任务,并加强了复杂指令执行与密集文字渲染,帮助营销、电商和设计团队持续完善同一组视觉素材。

OpenAI模型品牌
图像模型类型
图像任务能力

规格与接口特性

在选型前明确容量、输入输出与调用方式。

创作方式
文字生成图像;图片结合文字指令编辑
参考图输入
平台编辑入口:单个图片 URL 或最多 16 个 URL 的数组
输出文件
平台入口:png、jpeg、webp
结果形式
平台入口:url 或 b64_json;支持图像结果及 task_id 响应结构
背景控制
平台入口:transparent、opaque、auto
编辑保真控制
平台编辑入口:input_fidelity 可选 high 或 low

图像创作与细节保留属于模型能力,参考图数量、文件格式及结果形式为本平台入口的调用规格。

核心能力

了解 gpt-image-1.5 能为你的工作带来什么。

修改目标,保留画面核心

GPT Image 1.5 擅长在已有图片上添加、删除、组合或替换元素,同时尽量保留光照、构图和人物外貌。修改服装、背景或产品配色时,可把必须保持不变的内容写清楚,让编辑围绕目标展开,而不是重新设计整张画面。

复杂构图更贴近指令

面对包含多个对象、明确位置关系或分区布局的创作要求,模型更重视元素之间的关系。可将主体、空间位置、视觉层级和风格分别描述,用于广告概念图、组合画面与信息海报;复杂任务仍应检查对象数量和位置是否准确。

文字与品牌视觉共同创作

模型增强了较小、较密集文字的渲染,也改善了编辑过程中品牌标识与关键视觉的保留。适合把标题、产品图和版式一起构思,减少文字与画面割裂的草稿。正式发布前仍需逐项校对文字,并检查标识细节是否发生变化。

适用场景

从具体任务出发,找到模型发挥作用的位置。

电商产品场景扩展

输入产品图片和目标场景说明,要求保留外形、配色及标识,只改变环境、道具或展示角度。可制作商品目录候选图、节日场景图和不同风格的展示素材,再由团队筛选;产品细节应与实物逐项比对,避免把生成变化当作真实规格。

营销海报与活动素材

提供活动主题、标题文案、品牌图片及版式要求,让模型生成含文字的广告画面,或修改已有海报中的背景与装饰元素。交付物可作为社交媒体素材、活动视觉草稿和设计提案,再针对文字准确性、信息层级与品牌一致性完成审校。

人物造型与风格探索

以人物照片为基础,描述服装、发型、环境或艺术风格的变化,并明确要求保留面部特征与姿态。适合制作造型提案、角色视觉稿和创意肖像候选图。连续修改时保留原图作为对照,有助于发现人物外貌或局部细节的偏移。

如何选择这个模型

结合任务复杂度、输入材料与预期结果选择。

与 GPT Image 1 如何取舍

如果任务重点是已有图片的精确修改、品牌元素保留或含较多文字的视觉创作,GPT Image 1.5 比 GPT Image 1 更值得优先测试。它的改进集中在指令遵循、图像保留与编辑质量;若旧流程已满足需求,可用同一组素材比较结果,再决定是否调整。

从零创作还是基于原图编辑

尚无视觉素材、希望探索整体方向时,选择文字生成图像;已经确定产品、人物或构图,只需改动局部内容时,选择图片编辑。对细节敏感的任务可尝试 high 输入保真设置,并把修改项与保留项分开写,避免将高保真理解为像素级不变。

开始使用

从一次小规模任务到正式接入。

01

准备任务与材料

明确目标、必要输入与输出要求,使用真实业务样例作为起点。

02

在 API 调试区试用

打开试用页,确认此入口支持的参数,再提交小规模任务查看结果。

03

按 API 文档接入

保留完整模型 ID,使用文档规定的请求格式,并在 Pricing 页确认计费规则。

使用边界

在正式使用前,了解输出质量与能力范围。

  • 人物外貌保留有所增强,但多人画面仍可能出现面部细节偏差,连续编辑也不保证身份特征完全不变。需要稳定人物形象时,应对照原始照片检查眼睛、轮廓和配饰,避免只检查整体氛围。
  • 文字渲染改善不等于排版与拼写完全准确,尤其是多语言、密集小字和复杂标识。海报中的日期、价格、名称及正文应单独校对;要求精确字形的内容,可在确定画面后使用设计工具完成最终排版。
  • 生成画面可能存在科学或事实错误,也可能无法完整实现某种风格。模型适合视觉创作与素材迭代,不宜直接作为准确产品结构图或科学图解;结构、比例与专业信息需要人工检查。

常见问题

解答使用 gpt-image-1.5 时的常见疑问。

GPT Image 1.5 如何生成新图片?

向 /openai/images/generations 提交 model=gpt-image-1.5 和 prompt。提示词宜说明主体、背景、光照、布局和需要出现的文字;没有原图约束时,这种方式更适合探索完整画面与视觉方向。

如何用 GPT Image 1.5 编辑已有图片?

向 /openai/images/edits 提交 image、prompt,并显式填写 model=gpt-image-1.5。image 可使用单个图片 URL 或 URL 数组;指令应分别写清需要改变的元素,以及人物、产品、构图等必须保留的部分。

能否结合多张参考图进行创作?

编辑入口允许最多 16 个图片 URL。可以提供人物、产品或环境参考,并在提示词中说明每张图片的作用,以及哪些元素需要组合、哪些不可改变。参考图较多时,应避免互相矛盾的风格与外观要求。

适合生成带中文的海报吗?

可以尝试含中文标题和文案的海报创作,模型加强了密集与小字号文字渲染,但多语言表现仍有局限。建议明确提供原文、文字位置和层级,生成后逐字检查;长正文或严格品牌字体宜另行排版。

生成结果如何接入应用?

可选择 url 获取图片地址,或选择 b64_json 获取编码图像数据,并按用途选择 PNG、JPEG 或 WebP。响应可能包含 created/data,也可能返回 task_id;应用应分别处理完成图片和任务响应,不把任务编号当作图片结果。

模型资料 · 更新日期:2026-10-01。调用参数与计费规则请查看 API 和定价栏目。

把 gpt-image-1.5 用到你的下一项任务

从清晰的目标开始,在实际结果中判断它是否适合你的工作。