Skip to main content
POST
编辑接口接收一张或多张源图,加上描述改动的提示词。带遮罩时只重绘透明区域;不带遮罩时,模型会参照源图重绘整幅画面。 两种请求编码都可以,PipeLLM 均原样透传:
  • multipart/form-data,直接上传图像字节。OpenAI SDK 发的就是这种。
  • application/json,用 images 数组传 file_id 或 image_url,最多 16 张参考图。
file | array
必填
源图,可以多张。multipart 下用 image[] 传文件部分,JSON 下用 images 数组。支持 PNG、JPEG、WebP。
string
必填
编辑后的图像应该呈现什么。GPT 图像模型上限 32,000 字符。
string
图像模型 ID,例如 gpt-image-2.5-sunburst。
file
一张 PNG,其中透明像素标记需要重绘的区域,尺寸必须和源图一致。不传则由模型编辑整幅图像。
integer
默认值:"1"
返回数量,1–10。
string
默认值:"auto"
auto、1024x1024、1536x1024、1024x1536,或能被 16 整除的自定义 宽x高。
string
默认值:"auto"
low、medium、high 或 auto。gpt-image-2.5 系列额外支持 xhigh 和 max。
string
默认值:"low"
high 会更严格地保留源图里的人脸、logo 和细节纹理,代价是输入 token 更多;low 给模型更大的发挥空间。
string
默认值:"auto"
transparent、opaque 或 auto。透明背景要求输出为 png 或 webp。
string
默认值:"png"
png、jpeg 或 webp。
integer
默认值:"100"
压缩级别 0–100,仅对 jpeg 和 webp 生效。
string
稳定的终端用户标识。
响应结构与 生成图像 一致:图像字节以 base64 放在 data[].b64_json,usage.input_tokens_details.image_tokens 对应你上传的源图。

组合多张参考图

传多张源图时,模型会跨图合成——比如商品加场景、人物加服装。顺序有意义:提示词里描述参考图的顺序要和你传入的顺序一致,例如「把第一张参考图里的人物换上第二张参考图里的服装」。 遮罩只作用于第一张图。

长时间请求

编辑接口的保活行为和生成一致:上游静默 90 秒后,网关每 30 秒在 JSON 响应体之前写入一个空白填充块。见 长时间请求。

错误

错误信封与 错误处理 一致。
遮罩尺寸与源图不一致、上传文件无法解析,或 size 取值模型不接受。
上传体积超出限制。请先把源图缩小再发送。