API 目录

控制推理模型努力程度

POST
/v1/chat/completions

控制推理模型的推理强度

POST https://www.vortapapi.com/v1/chat/completions

通过 Chat Completions 接口发送对话请求时,可以为支持推理能力的模型设置推理强度。推理强度会影响模型在回答前投入的思考量:强度越高,通常推理更充分,但响应时间和 token 消耗也可能增加。

请求头

名称必填说明
Content-Type请求体格式,通常为 application/json
Accept响应格式,通常为 application/json
AuthorizationAPI 密钥,例如 Bearer sk-***
X-Forwarded-Host透传的原始主机信息,通常无需手动设置

请求体参数

参数类型必填说明
modelstring要调用的模型名称。
messagesarray对话消息列表。
reasoning_effortstring控制推理模型的思考强度。常见取值包括 lowmediumhigh
streamboolean是否以流式方式返回结果。

请求示例

curl https://www.vortapapi.com/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Accept: application/json" \
  -H "Authorization: Bearer sk-***" \
  -d '{
    "model": "reasoning-model",
    "messages": [
      {
        "role": "user",
        "content": "请解释为什么天空是蓝色的。"
      }
    ],
    "reasoning_effort": "medium"
  }'

响应示例

{
  "id": "chatcmpl-123",
  "object": "chat.completion",
  "created": 1677652288,
  "choices": [
    {
      "index": 0,
      "message": {
        "role": "assistant",
        "content": "\n\nHello there, how may I assist you today?"
      },
      "finish_reason": "stop"
    }
  ],
  "usage": {
    "prompt_tokens": 9,
    "completion_tokens": 12,
    "total_tokens": 21
  }
}

推理强度说明

说明
low使用较少推理步骤,适合简单问题或对延迟敏感的场景。
medium默认均衡设置,兼顾响应质量、速度和成本。
high投入更多推理计算,适合复杂分析、数学推导、代码规划等任务。

返回字段说明

字段类型说明
idstring本次补全请求的唯一标识。
objectstring对象类型,Chat Completions 响应通常为 chat.completion
createdinteger响应创建时间,Unix 时间戳格式。
choicesarray模型生成的候选结果列表。
choices[].indexinteger当前候选结果在列表中的序号。
choices[].messageobject模型返回的消息内容。
choices[].message.rolestring消息角色,通常为 assistant
choices[].message.contentstring模型生成的文本内容。
choices[].finish_reasonstring生成结束原因,例如 stop
usageobjecttoken 使用统计。
usage.prompt_tokensinteger输入提示消耗的 token 数。
usage.completion_tokensinteger输出内容消耗的 token 数。
usage.total_tokensinteger本次请求总 token 数。