图像生成接口
通过球球 Token 的 OpenAI 兼容图片接口发起图片生成与编辑请求。
通过球球 Token 调用 gpt-image-2 时,可以使用 OpenAI 兼容的图片生成与图片编辑接口。请求前请先完成快速接入中的账户、余额和 API 令牌准备;令牌分组请选择支持 gpt-image-2 的 视觉 分组,不要保留 default。
完整字段、可选值和响应结构请查阅:
生成图片
标题“生成图片”的锚点生成接口使用 JSON 请求体。
curl https://api.qiuqiutoken.net/v1/images/generations \
-H "Authorization: Bearer sk-your-token" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-image-2",
"prompt": "一只戴透明雨衣的橘猫站在霓虹雨夜街头,电影感构图",
"size": "1024x1024",
"quality": "high",
"output_format": "png"
}'生成参数
标题“生成参数”的锚点| 字段 | 是否必填 | 说明 |
|---|---|---|
prompt |
必填 | 图片提示词。建议写清楚主体、场景、光线、构图和风格。 |
model |
推荐填写 | 在球球 Token 网关中填写 gpt-image-2。 |
size |
可选 | 常见值包括 1024x1024、1536x1024、1024x1536 和 auto。 |
quality |
可选 | 常见值为 low、medium、high、auto;更高质量通常更慢、费用也更高。 |
background |
可选 | 常见值为 transparent、opaque、auto;透明背景需要配合 png 或 webp 输出。 |
output_format |
可选 | 常见值为 png、jpeg、webp。 |
output_compression |
可选 | 官方范围为 0 到 100,仅在 jpeg 或 webp 输出时有意义。 |
n |
可选 | 生成张数。官方范围为 1 到 10。 |
moderation |
可选 | GPT Image 的审核强度,常见值为 low 和 auto。 |
user |
可选 | 业务侧终端用户标识,便于审计、风控或日志关联。 |
生成响应
标题“生成响应”的锚点GPT Image 系列通常返回 Base64 图片内容,而不是可直接访问的图片 URL。重点读取 data[*].b64_json:
{ "created": 1711111111, "data": [ { "b64_json": "iVBORw0KGgoAAAANSUhEUgAA..." } ]}编辑图片
标题“编辑图片”的锚点编辑接口使用 multipart/form-data 上传原图、可选蒙版和文本提示词。OpenAI 参考文档会把输入图表示为 images 数组;使用 multipart 上传文件时,常见写法是 image[]=@...。
curl https://api.qiuqiutoken.net/v1/images/edits \
-H "Authorization: Bearer sk-your-token" \
-F "model=gpt-image-2" \
-F "image[]=@./input.png" \
-F "mask=@./mask.png" \
-F "prompt=保留主体姿势,把背景改成雨夜霓虹街道,增强电影感和反射光" \
-F "size=1024x1024" \
-F "quality=high" \
-F "background=transparent" \
-F "input_fidelity=high" \
-F "output_format=png" \
-F "n=1"编辑参数
标题“编辑参数”的锚点| 字段 | 是否必填 | 说明 |
|---|---|---|
images / image[] |
必填 | 要编辑的输入图片。GPT Image 模型官方支持最多 16 张输入图;multipart 上传时通常使用 image[]=@./input.png。 |
prompt |
必填 | 编辑意图说明。建议明确写出“保留什么、替换什么、补什么”。 |
model |
推荐填写 | 在球球 Token 网关中填写 gpt-image-2。 |
mask |
可选 | 蒙版可以通过文件上传或官方支持的引用方式提供;透明区域表示可编辑区域。 |
size |
可选 | 常见值包括 1024x1024、1536x1024、1024x1536 和 auto。 |
quality |
可选 | 常见值为 low、medium、high、auto。 |
background |
可选 | 常见值为 transparent、opaque、auto;透明背景需要配合 png 或 webp 输出。 |
input_fidelity |
可选 | 控制对原图细节的保留强度,常见值为 low 和 high。 |
output_format |
可选 | 常见值为 png、jpeg、webp。 |
output_compression |
可选 | 官方范围为 0 到 100,仅在 jpeg 或 webp 输出时有意义。 |
n |
可选 | 返回图片数量。官方范围为 1 到 10。 |
moderation |
可选 | GPT Image 的审核强度,常见值为 low 和 auto。 |
user |
可选 | 业务侧终端用户标识,便于审计、风控或日志关联。 |
保存返回图片
标题“保存返回图片”的锚点响应里拿到 b64_json 后,需要先解码,再写入图片文件。
import base64
b64 = "把响应里的 b64_json 粘贴到这里"
with open("gpt-image-output.png", "wb") as f:
f.write(base64.b64decode(b64))如果请求里使用了 background=transparent,保存文件时也应优先选择 png 或 webp,否则透明信息可能丢失。
