OpenAPI 参考
Modelink API · 图像
Modelink 图像生成 API,提供基于 OpenAI 格式的同步生成与基于 Fal 格式的异步任务能力。Fal 格式接口使用 Authorization: Key {api_key};其他接口使用 Bearer 鉴权。
版本 1.0.0
文生图
使用 GPT Image 2 或 GPT Image 2.5 根据文本提示词生成图片。GPT Image 系列走 openai-images 协议,可用模型 ID 为 openai/gpt-image-2、openai/gpt-image-2.5-flare 和 openai/gpt-image-2.5-sunburst。GPT Image 2.5 额外支持 xhigh/max 质量档,以及 background、output_compression 等输出控制字段;同步接口会将这些字段原样透传到上游。
认证方式
在 Authorization 请求头中传入 API Key 或访问令牌,格式:Bearer {token}。
请求体
请求体属性
- modelstring, 必填
模型名称。GPT Image 2 使用
openai/gpt-image-2;GPT Image 2.5 使用openai/gpt-image-2.5-flare或openai/gpt-image-2.5-sunburst。 - promptstring, 必填
图片生成提示词,必填,最长 32000 个字符,约相当于 5000~8000 个英文单词或 2 万个中文字符。
- qualityenum
输出质量。GPT Image 2 支持 low、medium、high、auto;GPT Image 2.5 额外支持 xhigh、max。默认 auto。同步接口不拦截质量枚举,会原样透传到 openai-images 渠道。
default: auto
lowmediumhighautoxhighmax
- sizestring
输出图像尺寸。默认 auto;常用值包括 1024x1024(方图)、1536x1024(横图)、1024x1536(竖图)、2048x2048(2K 方图)、2048x1152(2K 横图)、3840x2160(4K 横图)和 2160x3840(4K 竖图)。也支持自定义宽x高,要求宽高均为 16 的倍数、最大边不超过 3840、长短边之比不超过 3:1,且总像素数为 655360~8294400。
- backgroundenum
输出背景。可选
auto、transparent、opaque;不传则由上游处理。平台仅透传,不回填默认值。autotransparentopaque
- output_formatenum
输出图片格式。不传时由上游使用默认格式 png。
default: png
pngjpegwebp
- output_compressioninteger
输出压缩率,范围 0~100。仅当
output_format为jpeg或webp时可用;默认的png不支持该字段。minimum: 0; maximum: 100
请求
curl https://api.qnaigc.com/v1/images/generations \
--request POST \
--header 'Authorization: Bearer YOUR_BEARER_AUTH' \
--header 'Accept: application/json' \
--header 'Content-Type: application/json' \
--data '{
"model": "openai/gpt-image-2",
"prompt": "可爱的少女,动漫",
"quality": "high"
}'响应
响应体属性
- createdinteger, 必填
Unix 时间戳(秒)
- dataobject[], 必填
- b64_jsonstring, 必填
图片的 base64 数据(当前实现固定返回该字段)
- backgroundstring
可选,背景类型
- output_formatenum
可选,输出格式;当前实现默认会给 png
pngjpegwebp
- sizestring
可选,图像尺寸
- qualitystring
可选,图像质量
- usageobject
本次图片请求的用量。模型可能按 Token、请求次数或图片张数计费,以模型广场实际展示的计费项为准;详见 Usage 字段与计费对账。
additionalProperties: false
- total_tokensinteger
总 Token 数,通常等于 input_tokens 与 output_tokens 之和。
- input_tokensinteger
输入 Token 总量。
- output_tokensinteger
输出 Token 总量。
- ti_quantityinteger
文生图实际生成张数。
- ii_quantityinteger
单图生图实际生成张数。
- mi2i_quantityinteger
多图生图实际生成张数。
- req_countinteger
成功同步请求的计次,通常为 1;该字段不是生成图片张数。
- input_tokens_detailsobject
输入 Token 的分类明细,已包含在 input_tokens 中。
additionalProperties: false
- text_tokensinteger
文本输入 Token 数。
- image_tokensinteger
图片输入 Token 数。
- output_tokens_detailsobject
输出 Token 的分类明细,已包含在 output_tokens 中。
additionalProperties: false
- image_tokensinteger
图片输出 Token 数。
- reasoning_tokensinteger
推理 Token 数,通常是输出 Token 的子集。
- text_tokensinteger
文本输出 Token 数。
响应
{
"created": 42,
"data": [
{
"b64_json": "string"
}
],
"background": "string",
"output_format": "png",
"size": "string",
"quality": "string",
"usage": {
"total_tokens": 42,
"input_tokens": 42,
"output_tokens": 42,
"ti_quantity": 42,
"ii_quantity": 42,
"mi2i_quantity": 42,
"req_count": 42,
"input_tokens_details": {
"text_tokens": 42,
"image_tokens": 42
}
}
}图生图
使用 GPT Image 2 或 GPT Image 2.5 编辑图片。GPT Image 系列走 openai-images 协议,可用模型 ID 为 openai/gpt-image-2、openai/gpt-image-2.5-flare 和 openai/gpt-image-2.5-sunburst。GPT Image 2.5 额外支持 xhigh/max 质量档,以及 background、output_compression 等输出控制字段;同步接口会将这些字段原样透传到上游。
输入图片
image可传单张图片,也可传图片数组;images是兼容字段,支持同样的输入格式。- 每张图片可以是公网可访问的图片 URL、
data:image/<格式>;base64,<数据>形式的 base64 data URI,或纯 base64 字符串。 - 数组元素可使用 OpenAI JSON 格式
{"image_url": "<图片 URL>"},也兼容{"url": "<图片 URL>"}。单次请求最多提供 16 张图片。 - 使用
application/json时,通过 URL 提供的单张图片大小上限为 40MB。 - 支持的图片格式:
png、jpeg、webp、gif。
输出尺寸
size 支持 auto 或 宽x高。常用尺寸包括 1024x1024、1536x1024、1024x1536、2048x2048、2048x1152、3840x2160、2160x3840。自定义尺寸需要同时满足:宽高均为 16 的倍数、最大边不超过 3840、长短边之比不超过 3:1、总像素数为 655,360~8,294,400。
认证方式
在 Authorization 请求头中传入 API Key 或访问令牌,格式:Bearer {token}。
请求体
请求体属性
- modelstring, 必填
模型名称。GPT Image 2 使用
openai/gpt-image-2;GPT Image 2.5 使用openai/gpt-image-2.5-flare或openai/gpt-image-2.5-sunburst。 - promptstring, 必填
图片编辑提示词,必填,最长 32000 个字符。
- imagestring[]
输入图片,与
images二选一且必须提供其中一个。可传单个字符串或图片数组;字符串支持公网 URL、base64 data URI 或纯 base64。数组最多 16 项,元素可使用 {image_url: string} 对象,也兼容 {url: string}。通过 URL 提供的单张图片大小上限为 40MB。- image_urlstring
OpenAI JSON 格式的图片地址。支持公网 URL、base64 data URI 或纯 base64 字符串。
- urlstring
兼容字段。支持公网 URL、base64 data URI 或纯 base64 字符串。
- anyOf[0]string可选。
- anyOf[1]可选。
- anyOf[2]可选。
- imagesstring[]
image的兼容字段,与image二选一且必须提供其中一个。输入格式与image相同。- image_urlstring
OpenAI JSON 格式的图片地址。支持公网 URL、base64 data URI 或纯 base64 字符串。
- urlstring
兼容字段。支持公网 URL、base64 data URI 或纯 base64 字符串。
- anyOf[0]string可选。
- anyOf[1]可选。
- anyOf[2]可选。
- maskstring
可选遮罩图片。支持公网 URL、base64 data URI 或纯 base64;建议使用带透明通道且与输入图片尺寸一致的 PNG,透明区域表示需要编辑的部分。通过 URL 提供时大小上限为 40MB。
- ninteger
生成图片数量。必须为正整数;不传时由上游使用默认值 1。
default: 1; minimum: 1
- sizestring
输出图像尺寸。支持 auto 或宽x高;常用值为 1024x1024、1536x1024、1024x1536、2048x2048、2048x1152、3840x2160、2160x3840。自定义尺寸要求宽高均为 16 的倍数、最大边不超过 3840、长短边之比不超过 3:1、总像素数为 655360~8294400。
default: auto
- qualityenum
输出质量。GPT Image 2 支持 low、medium、high、auto;GPT Image 2.5 额外支持 xhigh、max。不传时由模型使用默认质量。同步接口不拦截质量枚举,会原样透传到 openai-images 渠道。
lowmediumhighautoxhighmax
- output_formatenum
输出图片格式。不传时由上游使用默认格式 png。
default: png
pngjpegwebp
- backgroundenum
输出背景。可选
auto、transparent、opaque;不传则由上游处理。平台仅透传,不回填默认值。autotransparentopaque
- output_compressioninteger
输出压缩率,范围 0~100。仅当
output_format为jpeg或webp时可用;默认的png不支持该字段。minimum: 0; maximum: 100
请求
curl https://api.qnaigc.com/v1/images/edits \
--request POST \
--header 'Authorization: Bearer YOUR_BEARER_AUTH' \
--header 'Accept: application/json' \
--header 'Content-Type: application/json' \
--data '{
"model": "openai/gpt-image-2",
"prompt": "图片中增加一个人",
"image": [
"https://aitoken-public.qnaigc.com/example/generate-video/running-man.jpg"
],
"n": 1,
"size": "1024x1024",
"quality": "low",
"output_format": "png"
}'响应
响应体属性
- createdinteger, 必填
Unix 时间戳(秒)
- dataobject[], 必填
- b64_jsonstring, 必填
图片的 base64 数据(当前实现固定返回该字段)
- backgroundstring
可选,背景类型
- output_formatenum
可选,输出格式;当前实现默认会给 png
pngjpegwebp
- sizestring
可选,图像尺寸
- qualitystring
可选,图像质量
- usageobject
本次图片请求的用量。模型可能按 Token、请求次数或图片张数计费,以模型广场实际展示的计费项为准;详见 Usage 字段与计费对账。
additionalProperties: false
- total_tokensinteger
总 Token 数,通常等于 input_tokens 与 output_tokens 之和。
- input_tokensinteger
输入 Token 总量。
- output_tokensinteger
输出 Token 总量。
- ti_quantityinteger
文生图实际生成张数。
- ii_quantityinteger
单图生图实际生成张数。
- mi2i_quantityinteger
多图生图实际生成张数。
- req_countinteger
成功同步请求的计次,通常为 1;该字段不是生成图片张数。
- input_tokens_detailsobject
输入 Token 的分类明细,已包含在 input_tokens 中。
additionalProperties: false
- text_tokensinteger
文本输入 Token 数。
- image_tokensinteger
图片输入 Token 数。
- output_tokens_detailsobject
输出 Token 的分类明细,已包含在 output_tokens 中。
additionalProperties: false
- image_tokensinteger
图片输出 Token 数。
- reasoning_tokensinteger
推理 Token 数,通常是输出 Token 的子集。
- text_tokensinteger
文本输出 Token 数。
响应
{
"created": 42,
"data": [
{
"b64_json": "string"
}
],
"background": "string",
"output_format": "png",
"size": "string",
"quality": "string",
"usage": {
"total_tokens": 42,
"input_tokens": 42,
"output_tokens": 42,
"ti_quantity": 42,
"ii_quantity": 42,
"mi2i_quantity": 42,
"req_count": 42,
"input_tokens_details": {
"text_tokens": 42,
"image_tokens": 42
}
}
}