GPT Image 2.5 参考编辑与保真控制:GPT-Image2-Skill 的 reference edits、inpainting 与透明抠图实战指南

发布时间:2026/10/12 3:03:31
GPT Image 2.5 参考编辑与保真控制:GPT-Image2-Skill 的 reference edits、inpainting 与透明抠图实战指南 AI 技能媒体生成AI 应用【免费下载链接】GPT-Image2-SkillGPT Image 2/2.5 prompt gallery, image prompt library, agentic skill, and CLI for OpenAI image generation/editing项目地址https://gitcode.com/gh_mirrors/gp/GPT-Image2-Skill点击查看免费下载本文围绕 GPT-Image2-Skill 仓库中的 openai-image-2.5-editing.md 展开系统讲解 GPT Image 2.5 在参考编辑reference edits、翻译、inpainting 与透明抠图四类任务上的正确姿势如何在本地通过gpt-imageCLI 编排多输入参考、如何使用 mask、如何用--background transparent获得真正的透明 PNG以及如何在接受结果前按验收清单核查。读完本文你将掌握一套角色分配 → 变更/不变分离 → 显式建模 → 输出验证的完整可执行工作流并了解其背后的 CLI 源码与离线测试实现。1. 参考编辑的核心事实保真改进 ≠ 像素锁定GPT Image 2.5 在官方文档中被定位为参考与保真references and preservation能力增强的版本但仓库文档开门见山地给出了一个重要的边界改进的保真不是像素锁定not a pixel lock模型会尽力保留参考图的构图、身份、文字等要素但不会逐像素复制重复编辑会漂移repeated edits can drift一次编辑保留得很好不代表第二次、第三次编辑依然精确需要精确未变区域时必须依赖合成compositing而非提示词如果某个区域要求像素级原样不动正确做法是单独做合成步骤而不是指望生成式编辑自带该保证。这一判断贯穿本文所有小节提示词里的保留列表preservation list只是请求不是保真证明任何输出都必须靠人工/视觉 QA 验证。2. 本地工作流用现有 CLI 编排参考编辑仓库为编辑任务提供了完整的本地工作流共四步全部围绕 scripts/generate.py 或已安装的gpt-image命令展开2.1 第一步为每个输入分配角色先检查实际输入文件-i参数为每个输入分配一个明确角色基础场景base scene、身份identity、服装garment、风格style或插入对象inserted object。角色的分配必须与-i的重复顺序保持一致——CLI 会按-i出现的先后把文件依次传给编辑端点顺序即Image 1、Image 2……的语义。2.2 第二步把请求的变更与不变项分开把一次编辑严格限定为只改什么并显式声明其余全部不变。不要因为要做一个小编辑就顺手做一次 restyle重风格化。如果对如何分离变更与不变项有疑问只查阅 craft.md 的第 13 节Edit endpoint prompts must preserve invariants不要整篇加载。craft 第 13 节给出的编辑提示词模式是先命名目标变换 → 显式声明要保留的身份/布局/位置/可读性 → 用-i挂参考图、用-m做局部修改。多参考场景下要按序号和角色标识每个输入例如Image 1: product photo、Image 2: style reference、Image 3: logo/packaging并说明它们如何交互把 Image 2 的风格套用到 Image 1 的主体上、把 Image 3 的 logo 放到包装上、保留 Image 1 的布局。2.3 第三步显式指定模型不臆测参数模型必须显式传递使用 models.md 核对 API 参数契约。不要臆断 2.5 需要--input-fidelity high——input_fidelity默认省略2.5 上的显式low/high只是被转发到 API 的选择性请求并非已验证的支持详见第 5.2 节。同时不要臆断GPT 2.5这个名字对应某个 API 模型 ID——裸的gpt-image-2.5不是文档化的 API 别名模型选择必须在对话中解决后经--model显式传入。2.4 第四步对比变更区域与未变区域拿到输出后把被请求变更的区域与其余部分逐一对比。如果要做下一次经授权的编辑把本次实际通过验收的输出文件通过-i传回去。这里有一个必须理解的 CLI 事实CLI 不保留会话conversation也不会仅仅因为 prompt 里写了某个文件名就附加该图片——每次调用都是独立请求参考图只能靠-i实际传文件。这一点在 cli.py 的实现中可以确认编辑请求的image参数由-i解析出的文件句柄构成prompt 只是普通字符串。2.5 五类任务的验收清单原文档给出的验收检查表是编辑任务的核心交付物完整继承如下任务接受前必须检查翻译Translation已批准的替换文案、未翻译的残留、原始布局与 logo试穿 / 身份编辑Try-on / identity edit面部、表情、姿态、服装细节与合理的身体几何多参考合成Multi-reference composition每个插入元素的正确来源、比例、透视与光照抠图Cutout产品轮廓/标签、边缘光晕、毛发/玻璃/阴影、以及真实的 alpha 透明度多步编辑Multi-step edit本次请求的变更加上从原始不变项累积的漂移3. 命令行实现-i与-m的源码级行为3.1 端点路由何时走/v1/images/editsSKILL.md 定义了端点路由规则与 cli.py 的实现一一对应模式触发条件端点文生图Text-to-image不带-i/v1/images/generations参考编辑Reference edit一个或多个-i/v1/images/editsInpainting-i-m/v1/images/edits带 mask路由判定就是call_edit(client, args) if args.image else call_generate(client, args)这一行——只要-i出现即切到编辑端点。离线测试 tests/test_cli.py 验证了该路由带-i时请求路径为/v1/images/edits不带时为/v1/images/generations。3.2 多参考输入的次序与文件校验-i是 repeatable 参数actionappend多次出现即构成多参考输入。call_edit在发起请求前会逐个检查-i文件是否存在缺失即以退出码 2 终止且不发请求见 cli.py。测试 test_missing_edit_file_no_request 专门断言了文件缺失 → 退出码 2 → 零请求这一行为。但请注意CLI 只检查文件存在性不证明文件格式、alpha 通道或尺寸有效——这在 models.md 中明确提示实际调用前仍需人工校验输入与 mask 的真实约束。3.3 mask 的正确姿势mask 是编辑指导edit guidance不是保证的硬像素边界多个输入同时存在时mask作用于第一张图片即第一个-i对应的输入mask 的尺寸必须与该图片匹配并检查其 alpha 通道——透明区域表示要重新生成不透明区域表示保留CLI 帮助文本Alpha-channel PNG mask (opaque preserved, transparent regenerated)使用方式为-i 图片路径 -m 掩码路径CLI 强制--mask必须伴随--image否则直接报错退出cli.py测试 test_invalid_parameters_stop_before_request 覆盖了该校验还需核对官方对 mask 输入的格式约束尺寸、alpha、通道数等——这些约束属于 API 契约CLI 不代为校验。在测试 test_edit_and_multi_reference_mask_serialization 中可以看到编辑请求以 multipart 形式序列化-m的文件名会出现在请求体里且编辑请求不会携带input_fidelity与moderation字段与 models.md 中编辑请求不要添加 moderation的提示一致——Python 编辑签名不支持该参数。3.4 相关参数校验与退出码从 cli.py 可以看到一组与编辑场景直接相关的硬校验--quality xhigh/max仅允许 GPT Image 2.5 的 Flare/Sunburst含带日期的快照--background transparent与--format jpeg冲突透明必须 PNG 或 WebP--n限定 1–10--compression限定 0–100且 PNG 输出时该参数被忽略output_compression仅在 jpeg/webp 时发送见 cli.py 与测试 test_png_compression_omitted尺寸必须为 16 的倍数、最长边 ≤3840px、长宽比 ≤3:1、总像素落在 655,360–8,294,400 之间4K 快捷方式实际解析为3840x2160见 cli.py 的SIZE_SHORTCUTS。退出码约定0成功1API 错误/拒绝2参数错误或缺少密钥cli.py。另外客户端以OpenAI(max_retries0)创建cli.py禁用自动重试避免对可能计费的请求静默重发测试 test_api_errors_no_fallback_or_output 验证了 403/429 时不会回退、不会切换模型、不会产出文件。4. 透明输出与真实抠图抠图cutout任务使用 2.5 专属的透明背景能力命令形如gpt-image --model gpt-image-2.5-sunburst -p 给参考图 1 中的产品做透明抠图 \ -i product.jpg -f cutout.png --background transparent --format png要点来自原文档与 CLI 校验双重确认必须用--background transparent --format png或 webp不能用 JPEG——这是 cli.py 中的硬性校验transparentjpeg组合直接报错检查解码后的 alpha 通道一个画出来的棋盘格checkerboard图案不是透明度——常见错误是把棋盘格底纹当成透明底提示词里的保留列表本身不证明任何东西被保留如果任务要求精确未动像素要向用户说明需要单独的合成步骤把生成结果与原图按 alpha 蒙版合成不要声称生成式编辑自带该保证。5. 模型与参数选择2.5 的保真旋钮5.1 三个模型怎么选按 models.md 与 SKILL.md 的模型表选择精确 API 模型 ID典型用途Flaregpt-image-2.5-flare快速、日常生成与草稿Sunburstgpt-image-2.5-sunburst精确参考编辑与细节敏感工作Image 2gpt-image-2既有 Image 2 工作流与兼容性需求两个 2.5 模型也都有-2026-09-08结尾的快照 ID。两者都能生成和编辑Sunburst 不是编辑专用模型。CLI 默认模型仍是gpt-image-2兼容性默认但这个默认值不能替代 Agent 对模型选择的解析——模型选择必须经--model显式传递。5.2input_fidelity的省略优先这是编辑任务最容易踩的坑源码逻辑在 cli.py 与 cli.pymodel_rejects_input_fidelity用正则匹配gpt-image-2及其带日期快照——只有 Image 2 及快照会被丢弃该参数不是所有以gpt-image-2开头的名字2.5 上显式传入的low/high会被透传给 API但这是选择加入的请求官方文档并未将其宣传为 2.5 已验证支持因此默认策略是省略直到确认所选模型的行为。测试 test_fidelity_only_dropped_for_image2 精确验证了只对 gpt-image-2 及快照丢弃、对 2.5 透传的分界行为。5.3 quality 与 size 的约束2.5 的quality取值扩大到low/medium/high/xhigh/max/autoImage 2 到high为止CLI 默认high。起点建议非保证low廉价草稿与广泛探索多变体需用户授权medium常规探索、风格试探、成本均衡highCLI 默认适合最终资产、密集文字、图表与 UIxhigh/max2.5 专属用于更高质量工作但不应自动使用——预算敏感请求不要自动抬高质量档。尺寸方面文案里写4K不会设置 API 尺寸尺寸由--size决定auto、快捷方式或WIDTHxHEIGHT含上述 16 倍数/3840/3:1/像素范围约束。注意文档明确提示高于 2560×1440 属于实验性且同一 token 单价不意味着单图成本相同——请用返回的 usage 对比不同模型/尺寸/质量的真实开销。6. 可复用的单点变更保真编辑模板对于可复用的 change-only 提示词原文档指向社区模板中的Single-change preservation edit见 templates-gpt-image-2.5.md模板全文如下Edit reference image 1. Change only [TARGET OBJECT OR REGION]: [PRECISE REQUESTED CHANGE]. Preserve the subjects identity, expression, pose, framing, camera viewpoint, lighting, background, and all existing text unless the requested change requires otherwise. Maintain the original material texture and image character. Do not add unrelated objects, crop, or restyle the scene.该模板的起点配置为用基础图做 edit、sizeauto、qualitymedium且要检查返回的实际尺寸不要假设它等于输入尺寸。注意模板的验证边界它改编自社区作者原帖模型为 GPT Image 1.5的经验未被本仓库在 2.5 上本地复现且保留指令只是请求不是保真保证。视觉 QA 要点先对比请求区域的编辑前后再检查本应不变的一切——尤其文字、身份、纹理、构图与尺寸确认成功要靠视觉不要把一个提示词约束描述成像素级锁定。7. 仓库里的真实验证证据Sunburst 单参考编辑仓库的 sunburst-samples.md 记录了 2026-09-09 的五次已授权 live 运行SDK 2.32.0、gpt-image-2.5-sunburst、qualityhigh、n1、PNG、禁用自动重试其中两次是编辑端点Cafe cutaway以既有等距咖啡馆插画为参考做剖面图编辑/v1/images/edits2048x2048Winter chess edit以 chess-midgame.png 为参考做雪夜棋盘编辑/v1/images/edits1536x1024即下方展示的输出运行记录显示五次请求全部 HTTP 200、无重试、无模型切换三次生成请求用moderationauto两次编辑各带一个参考mask、input_fidelity 与编辑 moderation 均省略。视觉复核结论很值得借鉴雪景效果可见、棋盘与棋子的可见排布视觉上得到保留但仓库明确标注这不是像素级保真检查且棋局合法性同样不在该视觉复核范围内——这与第 1 节保真 ≠ 像素锁定的立场完全一致。同一运行还记录了元数据查询 404 但生成成功的现象models.retrieve返回404 model_not_found随后的图像请求却全部成功——因此诊断生成失败应以实际图像端点的响应为准而不是模型元数据。这些样例同样展示了可复用的 QA 视角编辑输出必须核对参考遵循度cafe 只渲染了两层封闭楼层、少于要求的三个与提示词一致性poster 的刀形阴影方向与提示不符并把这些作为可见局限记录在案。8. 官方示例与验证边界8.1 官方示例选择性查阅原文档列出 OpenAI 官方 Image Prompting 指南中与编辑相关的五类示例可按需选择性地查阅不是必读清单翻译并保留布局Translate while preserving layout保留身份、更换服装Preserve identity and change clothing组合多个参考Combine references透明产品抠图Create a transparent product cutout跨轮保持角色一致Keep a character consistent。对待这些示例的态度它们是任务示例不是拼写或事实准确性的保证也不代表该变体一定在用户的具体需求上胜出。官方迁移提示同样强调改进的保真不是像素锁定重复编辑会漂移精确未变区域需要合成而不是依赖提示词。8.2 验证边界哪些已验证、哪些待验证离线测试运行PYTHONPATHsrc python -m unittest discover -s tests -v可执行离线套件进程内 HTTP 响应无凭据、无付费生成。sunburst-samples.md 说明该套件含13 个请求/CLI 测试 5 个凭据来源测试依赖下限为openai2.32.0在 2.32.0 与 3.10.0httpx2两对版本上均通过live 验证范围仅覆盖Sunburst 生成与单参考编辑Flare、mask、透明度、xhigh/max、2.5 显式 input_fidelity 与社区模板仍需要各自的 live 验证见 models.md证据纪律不要用 mocked 请求、模型列表或他人示例当作本地成功生成每次 release 测试前核验有效密钥来源、端点、项目与组织记录精确的模型、提示词、尺寸、质量、响应/错误与输出路径并对透明度、精确文字、请求的编辑与保留区域逐一检查。9. 一句话总结这套方法论GPT Image 2.5 的参考编辑能力在 GPT-Image2-Skill 中落成了一条可执行的流水线分配输入角色 → 分离变更与不变项 → 显式选模型与参数省略 input_fidelity→ 用-i/-m组织输入 → 按任务验收清单做视觉 QA → 需要像素级保真时走独立合成。记住三件事保真不是像素锁定、prompt 保留列表不是保真证明、CLI 不会因为提示词里写了文件名就附加图片。配套的 cli.py 实现与 tests/test_cli.py 离线测试为这套流程提供了可复现、可审计的工程支撑。赞分享AI 技能媒体生成AI 应用【免费下载链接】GPT-Image2-SkillGPT Image 2/2.5 prompt gallery, image prompt library, agentic skill, and CLI for OpenAI image generation/editing项目地址https://gitcode.com/gh_mirrors/gp/GPT-Image2-Skill点击查看免费下载相关推荐GPT-Image2-Skill 实战GPT Image 2/2.5 生成与编辑的 Agent Runbook 与 CLI 完整指南GPT Image2 Skill 实战GPT Image 2/2.5 生成与编辑的 Agent Runbook 与 CLI 完整指南 本文以开源仓库 GPTAI 技能媒体生成AI 应用GPT-Image2-Skill 实战指南GPT Image 2/2.5 提示词图库、双 Agent Skill 与 CLI 全解析GPT Image2 Skill 实战指南GPT Image 2/2.5 提示词图库、双 Agent Skill 与 CLI 全解析 本篇指南围绕开源仓库 GAI 技能媒体生成AI 应用GPT-Image2-Skill 实战指南GPT Image 2/2.5 提示词画廊、双 Agent Skill 与 CLI 全解析GPT Image2 Skill 实战指南GPT Image 2/2.5 提示词画廊、双 Agent Skill 与 CLI 全解析 本指南以 GPT ImaAI 技能媒体生成AI 应用上一篇Anime4KCPP 项目安装与使用教程下一篇vue3-mindmap 常见问题解决方案创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

关于本文作者

来自尧图内容编辑团队

尧图内容编辑团队 内容团队

尧图内容编辑团队

本文由尧图网络内容编辑团队执笔。团队由资深项目经理、前端工程师与设计师组成,所有内容均来自亲手交付的真实项目,先讲清问题、再给出可落地的解法。尧图深耕北京网站建设十年,服务过京华建材集团、智造科技等各行业客户,把一线经验沉淀为可复用的行业观察。

  • 十年建站经验,覆盖建材、制造、服务、文创等
  • 项目经理把关选题与事实准确性
  • 工程师与设计师联合撰写专业细节
  • 统一编辑规范,保证文风与排版一致
  • 每月复盘转化数据,迭代选题方向

延伸阅读

相关资讯与近期热门内容

深度阅读推荐

建站决策前值得细读的三篇

网站改版的5个关键决策
2024-08-12

网站改版的5个关键决策

什么时候该改版、改到什么程度、如何避免流量掉光,京华建材集团改版复盘给出答案。

获取专属建站方案

看完文章,把您的行业与预算告诉我们,免费获取一份量身定制的官网建设方案与报价。

立即免费咨询