跳到主要内容

GPT Image 2

gpt-image-2gpt-image-2 4K 通过 OpenAI Images 兼容接口提供文生图和图像编辑。客户端只需要面向 PopGo 的公开模型 ID,不需要处理渠道或上游模型映射。

调用地址

POST https://api.popgo.site/v1/images/generations
POST https://api.popgo.site/v1/images/edits
Authorization: Bearer YOUR_API_KEY

/generations 使用 JSON;/edits 使用 multipart/form-data。图像编辑必须带至少一张 image 参考图。

模型与能力

模型适用场景规格提示
gpt-image-2文生图、图像编辑使用模型与价格页显示的可用尺寸和质量档位
gpt-image-2 4K文生图、图像编辑用于 4K 输出档位;具体尺寸以实时能力配置为准

文生图字段

字段类型必填说明
modelstringgpt-image-2gpt-image-2 4K
promptstring画面、主体、动作、构图和风格描述
sizestringWIDTHxHEIGHT 或模型支持的 auto;不要使用全角乘号 ×
qualitystring只有模型与价格页允许时才传;不要把它当作模型名
ninteger返回图片数量,默认 1;数量越多,消耗和等待时间越高
response_formatstringurlb64_json,以当前接口能力为准

文生图示例

curl https://api.popgo.site/v1/images/generations \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "YOUR_MODEL",
"prompt": "雨后城市街角的咖啡店,玻璃反光,电影感摄影",
"size": "1024x1024",
"n": 1,
"response_format": "url"
}'

图像编辑字段

编辑请求的文本字段仍然是 modelpromptsizequalitynresponse_format;参考图使用文件字段:

字段说明
image单张参考图;支持 PNG、JPEG、WebP 等接口允许的图像类型
image[]多张参考图;重复同名字段上传多张,顺序保持不变
mask需要局部编辑且模型允许时使用;未确认支持时不要传
curl https://api.popgo.site/v1/images/edits \
-H "Authorization: Bearer YOUR_API_KEY" \
-F "model=YOUR_MODEL" \
-F "image[]=@input.png" \
-F "image[]=@style.png" \
-F "prompt=保留第一张图的主体,把第二张图的配色应用到场景中"

响应与 Base64

{
"created": 1781837823,
"data": [{ "url": "https://api.popgo.site/generated/FILE.png" }]
}

默认优先读取 data[].url。如果请求使用 response_format=b64_json,结果通常是:

{ "data": [{ "b64_json": "iVBORw0KGgo..." }] }

b64_json 是图片二进制内容的 Base64 文本,不带 data:image/png;base64, 前缀。需要在浏览器显示时,应自行补上正确 MIME 类型或先解码保存。

限制与排查

  • sizequalityn 必须同时符合目标模型的实时能力;不要因为模型名称包含 4K 就擅自拼接未列出的尺寸。
  • 图像编辑不能把本地路径字符串直接放入 JSON。使用 multipart 文件上传;若客户端只有公网 URL,应先下载为文件再上传。
  • 返回 URL 可能有保留期,成功后请尽快下载或转存。
  • HTTP 400 优先检查 modelpromptsizequalityn 和 multipart 字段名;HTTP 502 或无法解析结果时保留请求时间和脱敏响应结构,便于定位上游格式问题。

计费按模型与价格页配置执行;n 会影响返回张数和可能的额度消耗,不要为了测试随意设置大值。