ChatGPT 中文

OpenAI 图像生成模型

GPT‑Image‑2

从一句描述到可直接使用的视觉作品,也可以对现有图片进行高保真、可迭代的编辑。

适用于图片生成、图片编辑、营销素材、文字海报、产品图和透明背景素材。

GPT-Image-2 生成的月球上戴墨镜的青岛啤酒柴犬宇航员示例
GPT‑Image‑2 虚构图像示例 · OpenAI Cookbook

01 · 模型简介

不仅生成图片,
还理解你的意图。

GPT‑Image‑2 是 OpenAI 面向高质量图像生成和编辑的先进模型。它接受文本输入,也能接收图片作为参考,并输出生成或编辑后的图片。官方将其推荐为新图像工作流的默认选择。

查看 OpenAI 官方模型说明 ↗
输入

文字 + 图片

输出

高质量图片

质量

Low / Medium / High

工作流

生成 + 编辑 + 迭代

02 · 核心能力

更快、更准,
也更适合实际创作。

01

高质量生成

更自然的光线、材质、色彩和真实感,适合产品、人物与场景视觉。

02

高保真编辑

修改背景、颜色、构图或局部内容时,更好地保留主体特征和视觉一致性。

03

图中文字

支持海报、包装和信息图中的文字渲染,但重要文字仍建议生成后校对。

04

灵活尺寸

API 支持满足约束的自定义分辨率,并兼容方形、横版与竖版常用规格。

05

透明背景

透明 PNG 和 WebP 处于预览阶段,可用于商品抠图、贴纸、图标和演示素材。

06

多轮修改

在 Responses API 或对话中逐步调整,适合从初稿到定稿的连续创作流程。

03 · 使用场景

一套模型,覆盖多种视觉任务。

电商产品图

更换背景、生成场景图、制作透明底商品素材。

品牌与广告

营销海报、社交媒体配图、活动视觉和文字排版。

人物与角色

肖像风格化、角色设定、多轮编辑与形象一致性。

信息图与演示

流程图、概念图、课程插图和演示文稿视觉素材。

UI 与创意草图

界面概念、场景预览、游戏资产和设计方向探索。

旧图编辑

扩图、局部替换、去除元素、调整光线和画面比例。

04 · 官方生成案例

看看它能生成什么。

GPT-Image-2 生成的带文字时尚广告示例
广告与文字排版

将标题和视觉布局直接融入宣传图。

GPT-Image-2 生成的透明背景商品素材示例
透明背景产品图

保留商品轮廓和标签,移除原始背景。

GPT-Image-2 将草图转换为写实山谷图片的示例
草图转写实画面

保留布局和透视,补充真实材质与光线。

提交给 GPT-Image-2 的原始山谷草图
编辑前 原始草图
GPT-Image-2 根据草图生成的写实山谷图片
编辑后 写实渲染

05 · 提示词教程

把需求写清楚,
比堆砌形容词更重要。

建议按照“主体 + 场景 + 构图 + 光线 + 风格 + 文字 + 输出限制”组织提示词。编辑图片时,再明确哪些内容必须保留、哪些内容允许修改。

产品图

白底商品素材

将参考图中的耳机完整保留,去除原背景,生成纯透明背景产品图。保持真实材质、边缘干净、无多余阴影,输出 PNG。

宣传海报

带中文标题

设计一张竖版科技新品海报,深蓝渐变背景,产品居中,顶部准确显示“重新定义创造力”,使用简洁无衬线中文字体,留出底部品牌信息区。

图片编辑

只修改指定区域

保留人物的脸部、姿势和服装不变,只把背景替换成雨后的东京街道。自然匹配人物现有光线,不添加其他人物,不改变画面比例。

通用公式

任务类型 + 主体细节 + 环境场景 + 构图镜头 + 光线色彩 + 视觉风格 + 必须保留 + 不要出现 + 尺寸格式

06 · 开发者 API

两种接入方式。

Image API

适合从单条提示词直接生成或编辑一张图片,可明确选择 gpt-image-2

Responses API

适合对话式、多步骤和多轮编辑流程,可在上下文中组合文本与图片输入。

阅读官方图像生成指南 ↗
JavaScript
import OpenAI from "openai";
 import fs from "fs";
 
 const openai = new OpenAI();
 
 const result = await openai.images.generate({
   model: "gpt-image-2",
   prompt: "一只水彩风格的机器人在图书馆阅读",
   size: "1024x1024",
   quality: "medium",
   output_format: "png"
 });
 
 const bytes = Buffer.from(
   result.data[0].b64_json,
   "base64"
 );
 
 fs.writeFileSync("image.png", bytes);

常用尺寸

1024×1024
1536×1024
1024×1536

自定义尺寸

宽高需为 16 的倍数,长短边比例不超过 3:1,并满足像素限制。

输出格式

PNG
JPEG
WebP

注意

API 可能要求完成组织验证;价格、限额和可用性以开发者控制台为准。

07 · 使用限制

能力很强,
仍然需要检查。

文字与细节

长文本、非常小的文字、复杂手指或精细关系仍可能出现错误,应在发布前检查。

事实与品牌

模型输出不等于真实照片或权威资料,Logo、产品信息和数据图表需要人工核对。

内容安全

提示词与生成内容会经过安全过滤,使用时应遵守平台政策和相关法律。

08 · 常见问题

关于 GPT‑Image‑2。

GPT-Image-2 是什么?

它是 OpenAI 的图像生成与编辑模型,支持文本和图片输入,并输出生成或编辑后的图片。

普通用户如何使用?

可在支持图像生成功能的 ChatGPT 入口中直接描述画面,也可以上传参考图并说明要修改的内容。具体额度取决于套餐与工作空间设置。

它可以编辑现有图片吗?

可以。可修改局部或整体,也能通过多轮提示逐步调整。提示词应写明必须保留和允许改变的部分。

支持透明背景吗?

支持预览阶段的透明背景。API 中需设置透明背景,并选择 PNG 或 WebP 输出格式。

与 GPT-Image-1.5 有什么区别?

官方将 GPT‑Image‑2 推荐为新项目默认模型,重点提升生成质量、编辑可靠性、文字图像和灵活尺寸支持;已有稳定工作流可在验证后迁移。

开始创造

把你的下一张图片,
描述出来。