GPT-Image 绘图
用 gpt-image-2.5 文生图、图片编辑,以及在 Cherry Studio 中绘图
前置准备
在控制台「API 密钥」页面新建一个密钥,候选分组选择包含 gpt-image-2.5 的分组(见 API 密钥)。可以先到 模型广场 搜索 gpt-image 确认哪些分组有这个模型。
| 模型名 | 说明 |
|---|---|
gpt-image-2.5 | 文生图、图片编辑 |
gpt-image-2.5-sunburst | 部分分组提供,以模型广场为准 |
调用方式
出图请使用 Images API,不要用 Chat Completions 或 Responses:
| 接口 | 用途 | 建议 |
|---|---|---|
POST /v1/images/generations | 文生图 | 推荐 |
POST /v1/images/edits | 上传图片编辑 / 图生图 | 推荐 |
/v1/chat/completions | — | 不支持出图,size、quality 等参数不会生效 |
/v1/responses | — | 不支持用 image_generation 工具出图 |
新手先这样用
只传 model、prompt,n 设为 1。需要上传图片时再用 /v1/images/edits 的 image 字段。
文生图:/v1/images/generations
curl https://omini.ominiapi.top/v1/images/generations \
-H "Authorization: Bearer 你的 API Key" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-image-2.5",
"prompt": "一只橘猫戴着橙色围巾抱着水獭,温暖插画风格",
"size": "1536x1024",
"quality": "high",
"output_format": "png",
"n": 1
}'| 参数 | 类型 | 说明 |
|---|---|---|
model | string | 填 gpt-image-2.5 |
prompt | string | 必填。写清楚主体、场景、风格、比例和图中文字 |
n | integer | 建议填 1。多张图请自己循环请求 |
size | string | auto 或符合下方限制的尺寸,如 1024x1024、1536x1024、3840x2160 |
quality | string | low / medium / high / auto。草稿用 low,正式出图用 high |
response_format | string | url 或 b64_json |
output_format | string | 推荐 png 或 jpeg |
output_compression | integer | 0–100,只在 output_format 为 jpeg 时使用 |
background | string | 用默认值或 opaque |
moderation | string | auto / low,安全审核参数,不影响画风 |
stream | boolean | 不支持,不要开启 |
图片编辑:/v1/images/edits
用 multipart/form-data 上传图片,prompt 写清楚要保留什么、修改什么:
curl https://omini.ominiapi.top/v1/images/edits \
-H "Authorization: Bearer 你的 API Key" \
-F 'model=gpt-image-2.5' \
-F 'prompt=保留图片主体,在右上角加一枚红色小印章,印章上写 DEMO' \
-F 'image=@/path/to/your-image.jpg' \
-F 'size=1024x1024' \
-F 'quality=high'除文生图的参数外,还支持:
| 参数 | 类型 | 说明 |
|---|---|---|
image | file | 必填,要编辑的图片。建议一次只传 1 张 |
mask | file | 可选,PNG 蒙版,透明区域是允许修改的位置;不传则整图编辑 |
input_fidelity | string | 传 high 尽量保留原图主体和细节 |
尺寸与质量
常用尺寸:
1024x1024正方形,1536x1024横向,1024x1536纵向2048x20482K 正方形,2048x11522K 横向3840x21604K 横向,2160x38404K 纵向auto自动(默认)
尺寸限制:
- 最大边长 ≤ 3840 像素;
- 宽和高都是 16 的倍数;
- 长边与短边之比不超过 3:1;
- 总像素数在 655,360 到 8,294,400 之间。
返回结果
{
"created": 1776923999,
"data": [
{ "url": "https://...", "revised_prompt": "..." }
]
}url 直接访问即可下载。revised_prompt 是模型实际使用的改写后提示词,属于正常现象。
如果返回的是 b64_json,需要自己解码保存:
import base64
from openai import OpenAI
client = OpenAI(api_key="你的 API Key", base_url="https://omini.ominiapi.top/v1")
resp = client.images.generate(
model="gpt-image-2.5",
prompt="一只橘猫戴着橙色围巾,温暖插画风格",
size="1024x1024",
n=1,
)
item = resp.data[0]
if item.b64_json:
open("out.png", "wb").write(base64.b64decode(item.b64_json))
else:
print(item.url)图片编辑用 client.images.edit(model=..., image=open("in.png", "rb"), prompt=...),返回格式相同。
在 Cherry Studio 中使用
按上面的「前置准备」创建密钥并复制。到 Cherry Studio 官网 下载安装。
打开 Cherry Studio,点击左下角「设置」→「模型服务」→ 底部「添加」,提供商名称填 OminiApi-Image,提供商类型选 OpenAI。
API 密钥填刚才的 Key,API 地址填 https://omini.ominiapi.top(不用手动加 /v1)。
点击「获取模型列表」,添加 gpt-image-2.5。再点模型右侧的编辑按钮,把端点类型设为 图像生成(OpenAI),保存。
回到首页,点击顶部 +,在应用列表中选择「绘画」。左侧提供商选 OminiApi-Image,模型选 gpt-image-2.5。首次使用建议尺寸、质量保持「自动」,生成数量保持 1。
- 只根据提示词出图:顶部选「绘图」模式,输入提示词发送;
- 上传参考图修改:切到「编辑」模式,在「输入图片」上传参考图,再输入修改要求。
在普通对话页直接调用 gpt-image-2.5 时请关闭「流式输出」,否则可能解析异常。用「绘画」应用一般不需要额外处理。
常见问题
Cherry Studio 提示 Failed to fetch 或请求在 1 分钟左右断开
绘图请求比聊天耗时久得多,高清、高分辨率或编辑模式可能要 1–3 分钟。如果本机代理或网络工具限制了长连接,会在约 60 秒时断开。
解决办法:在代理工具里把 ominiapi.top 加入直连规则(类似 domain:ominiapi.top),让访问平台不经过代理。
提示 Unexpected token '<' ... is not valid JSON
请求过程中收到了网页内容而不是 JSON,一般是网络中途出错,直接重试即可。
返回 streaming Images API is not supported
去掉请求里的 "stream": true,Images API 不支持流式。
模型列表里没有 gpt-image-2.5
检查密钥分组是否包含绘图模型;在 Cherry Studio 中重新「获取模型列表」。如果能看到模型但画不出图,检查端点类型是否为 图像生成(OpenAI)。