OpenAPI 参考

Modelink API · 聊天与批量推理

Modelink 聊天对话与异步批量推理 API,涵盖 OpenAI 兼容 Chat Completions、Anthropic Messages、Vertex/Gemini 原厂协议及批量任务生命周期管理。所有请求均需使用 API Key 进行身份认证;Anthropic Messages 和 Vertex/Gemini 接口优先使用对应原厂请求头,同时兼容 Bearer Token。

版本 1.0.0

Chat Completions(对话补全)

POST
/v1/chat/completions

通用对话补全接口,兼容 OpenAI Chat Completions 协议,可通过请求体中的 model 字段切换底层模型(聊天、视觉、思考、文生图等)。支持流式输出、多模态输入(文本/图片/视频/文件/音频)、函数调用与结构化输出。

Gemini 生图:选择 Gemini 生图模型后,可通过同一接口完成文生图、图生图或纯对话。普通响应和 stream: true 的流式响应都在当前请求连接内返回结果;生成图片位于 message.images,推理过程位于 message.reasoning_content。使用 image_config 设置画幅比例和分辨率。

各模型的「思考 / 推理」开关方式不同,请按模型选择对应字段:

模型系列控制字段说明
Gemini 2.5 / 3.xreasoning_effortthinkingreasoning_effort 可选 low/medium/high;Gemini 3.1 Pro 仅支持这三档;Gemini 2.5 Pro 思考无法关闭
OpenAI GPT-5 / GPT-5.2reasoning_effortreasoningreasoning_effort 可选 low/medium/high/minimal/none;GPT-5.2 推荐 reasoning: {effort, summary},输出默认不展示思考内容
Claude 4.xthinking{"type": "enabled", "budget_tokens": N} 开启并设预算,{"type": "disabled"} 关闭
DeepSeekthinking{"type": "enabled"} 开启,{"type": "disabled"} 关闭
通义千问 Qwen3enable_thinking布尔值开关思考模式
豆包 Doubaothinking / enable_thinking通过 thinkingchat_template_kwargs 控制

多模态输入:在 messages[].content 中混合 textimage_urlfile(视频/文档/音频)等类型;file_id 可填公网 URL、GCS URI、YouTube 链接或经文件接口上传得到的 qfile- 标识。

媒体理解分辨率image_url.detail 对应 Gemini 的 media_resolution,支持 low/medium/high/ultra_high

结构化输出:通过 response_format 指定 json_object 或带 json_schema 的结构化约束。

安全设置:Gemini 模型可通过 safety_settings 调整各危害类别的拦截阈值。

认证方式

BearerAuthBEARER

Authorization 请求头中传入 API Key 或访问令牌,格式:Bearer {token}

Bearer 格式:JWT

请求体

请求体属性

  • modelstring, 必填

    模型名称

  • messagesobject[], 必填

    对话消息列表

    • roleenum

      消息角色

    • contentstring | object[]

      消息内容,可以是字符串或内容对象数组

    • namestring | null

      函数名称或用户名称

    • function_callobject

      函数调用信息(仅限role为function时填写)

    • tool_call_idstring | null

      工具调用ID(仅限role为tool时填写)

    • tool_callsobject[]

      工具调用列表(仅限role为assistant时填写)

    • reasoning_contentstring

      推理内容

    • imagesobject[]

      图片列表

    • thinking_blocksobject[]

      思考块列表

  • streamboolean

    是否使用流式响应

    default: false

  • max_tokensinteger | null

    生成的最大token数

  • presence_penaltynumber | null<float>

    存在惩罚系数,范围 -2.0 到 2.0

    minimum: -2; maximum: 2

  • frequency_penaltynumber | null<float>

    频率惩罚系数,范围 -2.0 到 2.0

    minimum: -2; maximum: 2

  • repetition_penaltynumber | null<float>

    重复惩罚系数

  • temperaturenumber | null<float>

    采样温度,范围 0.0 到 2.0

    minimum: 0; maximum: 2

  • top_pnumber | null<float>

    核采样参数,范围 0.0 到 1.0

    minimum: 0; maximum: 1

  • top_kinteger | null

    Top-K采样参数

  • toolsobject[]

    函数工具列表

    • typeenum, 必填

      工具类型

    • functionobject, 必填

      工具函数定义

  • tool_choiceobject

    工具选择策略,可以是字符串或对象

  • typestring | null

    请求类型

  • enable_thinkingboolean | null

    是否启用思考模式

  • chat_template_kwargsobject

    腾讯模型支持的聊天模板参数

    • thinkingboolean

      腾讯DeepSeek思考参数

    • enable_thinkingboolean

      是否启用思考模式

    • thinking_budgetinteger

      思考token预算

  • thinkingobject

    思考类型配置

    • typeenum

      思考模式类型

    • budget_tokensinteger | null

      思考token预算

  • reasoningobject

    推理配置

    • effortenum

      推理强度

    • max_tokensinteger

      最大推理token数

    • excludeboolean

      是否排除推理内容

    • enabledboolean

      是否启用

  • reasoning_effortenum

    推理强度

  • modalitiesstring[]

    支持的模态类型列表

  • image_configobject

    图像配置参数

    • aspect_ratioenum

      图像宽高比,支持:1:1、1:4、1:8、3:2、2:3、3:4、4:1、4:3、4:5、5:4、8:1、9:16、16:9 和 21:9

    • image_sizeenum

      图像分辨率,支持 512、1K、2K、4K

  • response_formatobject

    响应格式配置。type=json_schema 时通过 json_schema 指定结构化输出。

    • typeenum

      响应格式类型。

    • json_schemaobject

      当 type=json_schema 时的结构定义。

  • safety_settingsobject[]

    Gemini安全设置列表

    • categorystring, 必填

      危害类别

    • thresholdenum, 必填

      阻止阈值

请求

POST/v1/chat/completions
curl https://api.qnaigc.com/v1/chat/completions \
  --request POST \
  --header 'Authorization: Bearer YOUR_BEARER_AUTH' \
  --header 'Accept: application/json' \
  --header 'Content-Type: application/json' \
  --data '{
  "model": "gemini-3.1-pro-preview",
  "messages": [
    {
      "content": [
        {
          "text": "什么是太阳",
          "type": "text"
        }
      ],
      "role": "user"
    }
  ]
}'

响应

object

请求成功

响应体属性

  • idstring

    对话完成 ID

  • objectenum

    对象类型

  • createdinteger<int64>

    响应创建时间戳(Unix 时间戳,秒)

  • modelstring

    使用的模型名称

  • choicesobject[]

    生成结果数组

    • indexinteger

      结果索引

    • messageobject
    • finish_reasonstring

      完成原因,通常为 stop

  • usageobject

    Token 使用统计信息。明细字段已包含在对应的顶层输入或输出总量中,不应重复相加;详见 Usage 字段与计费对账

    • prompt_tokensinteger

      输入 token 数

    • completion_tokensinteger

      输出 token 数

    • total_tokensinteger

      总 token 数

    • prompt_tokens_detailsobject
    • completion_tokens_detailsobject

响应

application/json
{
  "id": "chatcmpl-2f8236e9f2b34bd391289576d0e23e72",
  "object": "chat.completion",
  "created": 1764574464,
  "model": "gemini-3.1-flash-image-preview",
  "choices": [
    {
      "index": 0,
      "message": {
        "role": "assistant",
        "content": "",
        "reasoning_content": "**Analyzing the Icon Redesign**\n\nI'm focused on the icon's elements...",
        "images": [
          {
            "type": "image_url",
            "image_url": {
              "url": "data:image/png;base64,iVBORw0KGgoAAAANSUhEUgAABYAAAAMACAIAAAASU1SbA.........."
            },
            "index": 0
          }
        ]
      },
      "finish_reason": "stop"
    }
  ],
  "usage": {
    "prompt_tokens": 19,
    "completion_tokens": 1322,
    "total_tokens": 1341,
    "prompt_tokens_details": {
      "text_tokens": 19
    },
    "completion_tokens_details": {
      "reasoning_tokens": 202,
      "image_tokens": 1120
    }
  }
}