OpenAPI 参考

Modelink API · 图像

Modelink 图像生成 API,提供基于 OpenAI 格式的同步生成与基于 Fal 格式的异步任务能力。Fal 格式接口使用 Authorization: Key {api_key};其他接口使用 Bearer 鉴权。

版本 1.0.0

文生图

POST
/v1/images/generations

使用 GPT Image 2 或 GPT Image 2.5 根据文本提示词生成图片。GPT Image 系列走 openai-images 协议,可用模型 ID 为 openai/gpt-image-2openai/gpt-image-2.5-flareopenai/gpt-image-2.5-sunburst。GPT Image 2.5 额外支持 xhigh/max 质量档,以及 backgroundoutput_compression 等输出控制字段;同步接口会将这些字段原样透传到上游。

认证方式

BearerAuthBEARER

Authorization 请求头中传入 API Key 或访问令牌,格式:Bearer {token}

Bearer 格式:JWT

请求体

请求体属性

  • modelstring, 必填

    模型名称。GPT Image 2 使用 openai/gpt-image-2;GPT Image 2.5 使用 openai/gpt-image-2.5-flareopenai/gpt-image-2.5-sunburst

  • promptstring, 必填

    图片生成提示词,必填,最长 32000 个字符,约相当于 5000~8000 个英文单词或 2 万个中文字符。

  • qualityenum

    输出质量。GPT Image 2 支持 low、medium、high、auto;GPT Image 2.5 额外支持 xhigh、max。默认 auto。同步接口不拦截质量枚举,会原样透传到 openai-images 渠道。

    default: auto

  • sizestring

    输出图像尺寸。默认 auto;常用值包括 1024x1024(方图)、1536x1024(横图)、1024x1536(竖图)、2048x2048(2K 方图)、2048x1152(2K 横图)、3840x2160(4K 横图)和 2160x3840(4K 竖图)。也支持自定义宽x高,要求宽高均为 16 的倍数、最大边不超过 3840、长短边之比不超过 3:1,且总像素数为 655360~8294400。

  • backgroundenum

    输出背景。可选 autotransparentopaque;不传则由上游处理。平台仅透传,不回填默认值。

  • output_formatenum

    输出图片格式。不传时由上游使用默认格式 png。

    default: png

  • output_compressioninteger

    输出压缩率,范围 0~100。仅当 output_formatjpegwebp 时可用;默认的 png 不支持该字段。

    minimum: 0; maximum: 100

请求

POST/v1/images/generations
curl https://api.qnaigc.com/v1/images/generations \
  --request POST \
  --header 'Authorization: Bearer YOUR_BEARER_AUTH' \
  --header 'Accept: application/json' \
  --header 'Content-Type: application/json' \
  --data '{
  "model": "openai/gpt-image-2",
  "prompt": "可爱的少女,动漫",
  "quality": "high"
}'

响应

object
响应.

响应体属性

  • createdinteger, 必填

    Unix 时间戳(秒)

  • dataobject[], 必填
    • b64_jsonstring, 必填

      图片的 base64 数据(当前实现固定返回该字段)

  • backgroundstring

    可选,背景类型

  • output_formatenum

    可选,输出格式;当前实现默认会给 png

  • sizestring

    可选,图像尺寸

  • qualitystring

    可选,图像质量

  • usageobject

    本次图片请求的用量。模型可能按 Token、请求次数或图片张数计费,以模型广场实际展示的计费项为准;详见 Usage 字段与计费对账

    additionalProperties: false

    • total_tokensinteger

      总 Token 数,通常等于 input_tokens 与 output_tokens 之和。

    • input_tokensinteger

      输入 Token 总量。

    • output_tokensinteger

      输出 Token 总量。

    • ti_quantityinteger

      文生图实际生成张数。

    • ii_quantityinteger

      单图生图实际生成张数。

    • mi2i_quantityinteger

      多图生图实际生成张数。

    • req_countinteger

      成功同步请求的计次,通常为 1;该字段不是生成图片张数。

    • input_tokens_detailsobject

      输入 Token 的分类明细,已包含在 input_tokens 中。

      additionalProperties: false

    • output_tokens_detailsobject

      输出 Token 的分类明细,已包含在 output_tokens 中。

      additionalProperties: false

响应

application/json
{
  "created": 42,
  "data": [
    {
      "b64_json": "string"
    }
  ],
  "background": "string",
  "output_format": "png",
  "size": "string",
  "quality": "string",
  "usage": {
    "total_tokens": 42,
    "input_tokens": 42,
    "output_tokens": 42,
    "ti_quantity": 42,
    "ii_quantity": 42,
    "mi2i_quantity": 42,
    "req_count": 42,
    "input_tokens_details": {
      "text_tokens": 42,
      "image_tokens": 42
    }
  }
}

图生图

POST
/v1/images/edits

使用 GPT Image 2 或 GPT Image 2.5 编辑图片。GPT Image 系列走 openai-images 协议,可用模型 ID 为 openai/gpt-image-2openai/gpt-image-2.5-flareopenai/gpt-image-2.5-sunburst。GPT Image 2.5 额外支持 xhigh/max 质量档,以及 backgroundoutput_compression 等输出控制字段;同步接口会将这些字段原样透传到上游。

输入图片

  • image 可传单张图片,也可传图片数组;images 是兼容字段,支持同样的输入格式。
  • 每张图片可以是公网可访问的图片 URLdata:image/<格式>;base64,<数据> 形式的 base64 data URI,或纯 base64 字符串。
  • 数组元素可使用 OpenAI JSON 格式 {"image_url": "<图片 URL>"},也兼容 {"url": "<图片 URL>"}。单次请求最多提供 16 张图片。
  • 使用 application/json 时,通过 URL 提供的单张图片大小上限为 40MB
  • 支持的图片格式:pngjpegwebpgif

输出尺寸

size 支持 auto宽x高。常用尺寸包括 1024x10241536x10241024x15362048x20482048x11523840x21602160x3840。自定义尺寸需要同时满足:宽高均为 16 的倍数、最大边不超过 3840、长短边之比不超过 3:1、总像素数为 655,360~8,294,400。

认证方式

BearerAuthBEARER

Authorization 请求头中传入 API Key 或访问令牌,格式:Bearer {token}

Bearer 格式:JWT

请求体

请求体属性

  • modelstring, 必填

    模型名称。GPT Image 2 使用 openai/gpt-image-2;GPT Image 2.5 使用 openai/gpt-image-2.5-flareopenai/gpt-image-2.5-sunburst

  • promptstring, 必填

    图片编辑提示词,必填,最长 32000 个字符。

  • imagestring[]

    输入图片,与 images 二选一且必须提供其中一个。可传单个字符串或图片数组;字符串支持公网 URL、base64 data URI 或纯 base64。数组最多 16 项,元素可使用 {image_url: string} 对象,也兼容 {url: string}。通过 URL 提供的单张图片大小上限为 40MB。

    • image_urlstring

      OpenAI JSON 格式的图片地址。支持公网 URL、base64 data URI 或纯 base64 字符串。

    • urlstring

      兼容字段。支持公网 URL、base64 data URI 或纯 base64 字符串。

    • anyOf[0]string
      可选。
    • anyOf[1]
      可选。
    • anyOf[2]
      可选。
  • imagesstring[]

    image 的兼容字段,与 image 二选一且必须提供其中一个。输入格式与 image 相同。

    • image_urlstring

      OpenAI JSON 格式的图片地址。支持公网 URL、base64 data URI 或纯 base64 字符串。

    • urlstring

      兼容字段。支持公网 URL、base64 data URI 或纯 base64 字符串。

    • anyOf[0]string
      可选。
    • anyOf[1]
      可选。
    • anyOf[2]
      可选。
  • maskstring

    可选遮罩图片。支持公网 URL、base64 data URI 或纯 base64;建议使用带透明通道且与输入图片尺寸一致的 PNG,透明区域表示需要编辑的部分。通过 URL 提供时大小上限为 40MB。

  • ninteger

    生成图片数量。必须为正整数;不传时由上游使用默认值 1。

    default: 1; minimum: 1

  • sizestring

    输出图像尺寸。支持 auto 或宽x高;常用值为 1024x1024、1536x1024、1024x1536、2048x2048、2048x1152、3840x2160、2160x3840。自定义尺寸要求宽高均为 16 的倍数、最大边不超过 3840、长短边之比不超过 3:1、总像素数为 655360~8294400。

    default: auto

  • qualityenum

    输出质量。GPT Image 2 支持 low、medium、high、auto;GPT Image 2.5 额外支持 xhigh、max。不传时由模型使用默认质量。同步接口不拦截质量枚举,会原样透传到 openai-images 渠道。

  • output_formatenum

    输出图片格式。不传时由上游使用默认格式 png。

    default: png

  • backgroundenum

    输出背景。可选 autotransparentopaque;不传则由上游处理。平台仅透传,不回填默认值。

  • output_compressioninteger

    输出压缩率,范围 0~100。仅当 output_formatjpegwebp 时可用;默认的 png 不支持该字段。

    minimum: 0; maximum: 100

请求

POST/v1/images/edits
curl https://api.qnaigc.com/v1/images/edits \
  --request POST \
  --header 'Authorization: Bearer YOUR_BEARER_AUTH' \
  --header 'Accept: application/json' \
  --header 'Content-Type: application/json' \
  --data '{
  "model": "openai/gpt-image-2",
  "prompt": "图片中增加一个人",
  "image": [
    "https://aitoken-public.qnaigc.com/example/generate-video/running-man.jpg"
  ],
  "n": 1,
  "size": "1024x1024",
  "quality": "low",
  "output_format": "png"
}'

响应

object
响应.

响应体属性

  • createdinteger, 必填

    Unix 时间戳(秒)

  • dataobject[], 必填
    • b64_jsonstring, 必填

      图片的 base64 数据(当前实现固定返回该字段)

  • backgroundstring

    可选,背景类型

  • output_formatenum

    可选,输出格式;当前实现默认会给 png

  • sizestring

    可选,图像尺寸

  • qualitystring

    可选,图像质量

  • usageobject

    本次图片请求的用量。模型可能按 Token、请求次数或图片张数计费,以模型广场实际展示的计费项为准;详见 Usage 字段与计费对账

    additionalProperties: false

    • total_tokensinteger

      总 Token 数,通常等于 input_tokens 与 output_tokens 之和。

    • input_tokensinteger

      输入 Token 总量。

    • output_tokensinteger

      输出 Token 总量。

    • ti_quantityinteger

      文生图实际生成张数。

    • ii_quantityinteger

      单图生图实际生成张数。

    • mi2i_quantityinteger

      多图生图实际生成张数。

    • req_countinteger

      成功同步请求的计次,通常为 1;该字段不是生成图片张数。

    • input_tokens_detailsobject

      输入 Token 的分类明细,已包含在 input_tokens 中。

      additionalProperties: false

    • output_tokens_detailsobject

      输出 Token 的分类明细,已包含在 output_tokens 中。

      additionalProperties: false

响应

application/json
{
  "created": 42,
  "data": [
    {
      "b64_json": "string"
    }
  ],
  "background": "string",
  "output_format": "png",
  "size": "string",
  "quality": "string",
  "usage": {
    "total_tokens": 42,
    "input_tokens": 42,
    "output_tokens": 42,
    "ti_quantity": 42,
    "ii_quantity": 42,
    "mi2i_quantity": 42,
    "req_count": 42,
    "input_tokens_details": {
      "text_tokens": 42,
      "image_tokens": 42
    }
  }
}