GPT-5.4 Pro / GPT-5 Pro 等推理模型, 适用于数学 / 逻辑 / 代码场景
POST /v1/chat/completions
## 推理对话 (Reasoning Models) GPT-5.4 Pro 是 OpenAI 新一代**推理模型** (Reasoning Model), 内置 chain-of-thought 推理链, 在复杂场景下表现远超传统对话模型: - 复杂数学推导 / 证明 - 多步骤逻辑推理 - 代码生成 / 调试 / 重构 - 长上下文深度分析 (支持 1M token context) ### 支持的推理模型 | Model | Context Window | Output Limit | |---|---|---| | `gpt-5.4-pro` | 1M tokens | 128K tokens | | `gpt-5-pro` | 200K tokens | 100K tokens | ### 调用方式 跟普通 chat completions 完全一致, 使用 OpenAI 标准 SDK 即可, 无需安装额外依赖: ```python from openai import OpenAI client = OpenAI(api_key="sk-xxx", base_url="https://api.router.ai/v1") resp = client.chat.completions.create( model="gpt-5.4-pro", messages=[{"role": "user", "content": "Solve: x^2 - 5x + 6 = 0"}], max_completion_tokens=500, ) print(resp.choices[0].message.content) print("Reasoning tokens:", resp.usage.completion_tokens_details.reasoning_tokens) ``` ### 协议差异 (跟普通 chat model 的区别) - 必须使用 `max_completion_tokens` 字段 (不是 `max_tokens`); 该字段包含推理过程消耗的 token + 可见输出 token 之和 - 不支持自定义 `temperature` (推理模型行为固定, 传入会被忽略) - 不支持流式调用 (`stream: true`) — 请使用同步调用, 等推理完成后一次性返回 - 响应 `usage.completion_tokens_details.reasoning_tokens` 字段返回推理过程 token 计数 (透明化) - 可选参数 `reasoning_effort`: `"low"` / `"medium"` (默认) / `"high"`, 控制推理深度 (深度越高耗时越长) ### 适用场景建议 | 场景 | 推荐模型 | |---|---| | 简单对话 / 闲聊 | `gpt-4o` / `gpt-5.4` 普通模型 (更快、更便宜) | | 数学题 / 算法 / 推理 | `gpt-5.4-pro` | | 长上下文分析 (代码库 review / 论文阅读) | `gpt-5.4-pro` (1M context) | | 工具调用 (function calling) | `gpt-5.4-pro` (原生支持) | > 推理模型的响应延迟通常 10-30 秒, 比普通 chat 模型 (1-3 秒) 显著更长. 请设置合理的客户端超时 (建议 ≥60 秒).
model | string | required | 推理模型 ID, e.g. `gpt-5.4-pro` / `gpt-5-pro` |
messages | array | required | 对话消息数组, 每个元素含 `role` (system/user/assistant) + `content` (string 或多模态数组) |
max_completion_tokens | integer | 输出 token 上限 (含推理过程 token + 可见输出 token). 推理模型用此字段, **不要用 max_tokens** (已弃用) | |
reasoning_effort | string | 推理深度: `low` / `medium` (默认) / `high`. 深度越高推理更细致但耗时更长 | |
tools | array | 工具调用定义, 跟 OpenAI function calling 规范一致 | |
tool_choice | string | object | 工具调用策略: `auto` / `none` / `required` / `{type:'function',function:{name:'X'}}` | |
stream | boolean | **当前必须为 false**. 推理模型流式调用暂不支持, 设 true 会返 400 | |
user | string | 终端用户标识, 跟 OpenAI 一致, 用于审计 / 滥用追溯 |
200 — 成功. `usage.completion_tokens_details.reasoning_tokens` 字段返回推理过程 token 计数. `completion_tokens` 含 reasoning tokens 之和.400 — 请求参数错误. 常见: `stream=true` (推理模型流式暂不支持) / `max_tokens` 已弃用 (改用 `max_completion_tokens`)curl -X POST https://api.router.ai/v1/chat/completions \
-H "Authorization: Bearer $YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.4-pro",
"messages": [
{"role": "user", "content": "Solve: x^2 - 5x + 6 = 0"}
],
"max_completion_tokens": 500,
"reasoning_effort": "medium"
}'