高质量生成
更自然的光线、材质、色彩和真实感,适合产品、人物与场景视觉。
OpenAI 图像生成模型
从一句描述到可直接使用的视觉作品,也可以对现有图片进行高保真、可迭代的编辑。
适用于图片生成、图片编辑、营销素材、文字海报、产品图和透明背景素材。
01 · 模型简介
GPT‑Image‑2 是 OpenAI 面向高质量图像生成和编辑的先进模型。它接受文本输入,也能接收图片作为参考,并输出生成或编辑后的图片。官方将其推荐为新图像工作流的默认选择。
查看 OpenAI 官方模型说明 ↗文字 + 图片
高质量图片
Low / Medium / High
生成 + 编辑 + 迭代
02 · 核心能力
更自然的光线、材质、色彩和真实感,适合产品、人物与场景视觉。
修改背景、颜色、构图或局部内容时,更好地保留主体特征和视觉一致性。
支持海报、包装和信息图中的文字渲染,但重要文字仍建议生成后校对。
API 支持满足约束的自定义分辨率,并兼容方形、横版与竖版常用规格。
透明 PNG 和 WebP 处于预览阶段,可用于商品抠图、贴纸、图标和演示素材。
在 Responses API 或对话中逐步调整,适合从初稿到定稿的连续创作流程。
03 · 使用场景
更换背景、生成场景图、制作透明底商品素材。
营销海报、社交媒体配图、活动视觉和文字排版。
肖像风格化、角色设定、多轮编辑与形象一致性。
流程图、概念图、课程插图和演示文稿视觉素材。
界面概念、场景预览、游戏资产和设计方向探索。
扩图、局部替换、去除元素、调整光线和画面比例。
04 · 官方生成案例

将标题和视觉布局直接融入宣传图。

保留商品轮廓和标签,移除原始背景。

保留布局和透视,补充真实材质与光线。
05 · 提示词教程
建议按照“主体 + 场景 + 构图 + 光线 + 风格 + 文字 + 输出限制”组织提示词。编辑图片时,再明确哪些内容必须保留、哪些内容允许修改。
产品图
将参考图中的耳机完整保留,去除原背景,生成纯透明背景产品图。保持真实材质、边缘干净、无多余阴影,输出 PNG。
宣传海报
设计一张竖版科技新品海报,深蓝渐变背景,产品居中,顶部准确显示“重新定义创造力”,使用简洁无衬线中文字体,留出底部品牌信息区。
图片编辑
保留人物的脸部、姿势和服装不变,只把背景替换成雨后的东京街道。自然匹配人物现有光线,不添加其他人物,不改变画面比例。
通用公式
任务类型 + 主体细节 + 环境场景 + 构图镜头 + 光线色彩 + 视觉风格 + 必须保留 + 不要出现 + 尺寸格式
06 · 开发者 API
适合从单条提示词直接生成或编辑一张图片,可明确选择 gpt-image-2。
适合对话式、多步骤和多轮编辑流程,可在上下文中组合文本与图片输入。
import OpenAI from "openai";
import fs from "fs";
const openai = new OpenAI();
const result = await openai.images.generate({
model: "gpt-image-2",
prompt: "一只水彩风格的机器人在图书馆阅读",
size: "1024x1024",
quality: "medium",
output_format: "png"
});
const bytes = Buffer.from(
result.data[0].b64_json,
"base64"
);
fs.writeFileSync("image.png", bytes);常用尺寸
1024×1024
1536×1024
1024×1536
自定义尺寸
宽高需为 16 的倍数,长短边比例不超过 3:1,并满足像素限制。
输出格式
PNG
JPEG
WebP
注意
API 可能要求完成组织验证;价格、限额和可用性以开发者控制台为准。
07 · 使用限制
长文本、非常小的文字、复杂手指或精细关系仍可能出现错误,应在发布前检查。
模型输出不等于真实照片或权威资料,Logo、产品信息和数据图表需要人工核对。
提示词与生成内容会经过安全过滤,使用时应遵守平台政策和相关法律。
08 · 常见问题
它是 OpenAI 的图像生成与编辑模型,支持文本和图片输入,并输出生成或编辑后的图片。
可在支持图像生成功能的 ChatGPT 入口中直接描述画面,也可以上传参考图并说明要修改的内容。具体额度取决于套餐与工作空间设置。
可以。可修改局部或整体,也能通过多轮提示逐步调整。提示词应写明必须保留和允许改变的部分。
支持预览阶段的透明背景。API 中需设置透明背景,并选择 PNG 或 WebP 输出格式。
官方将 GPT‑Image‑2 推荐为新项目默认模型,重点提升生成质量、编辑可靠性、文字图像和灵活尺寸支持;已有稳定工作流可在验证后迁移。
开始创造