本页译自英文文档。命令、标识符和示例保持原样。运行时 7.24.4 · SDK 2.6.7。 英文原文
当前模型的推理控件
状态:生效
范围:当前状态
最近审阅:2026-09-14
负责人:ax-code 运行时
AX Code 使用上游模型 ID 和 SDK 协议来选择推理控件。这些配置档覆盖下方确切 ID 的 OpenAI 兼容 Chat 路由。它们保留现有的原生 SDK、私有 GPU、AX Engine 和受约束网关行为。
| 模型 ID | 可用努力程度 | 自主 / 反复工具失败 | 辅助请求 |
|---|---|---|---|
qwen3.8-max、qwen3.8-flash |
low(低)、medium(中)、xhigh(超高);high 是 xhigh 已有的别名 | xhigh(超高) | 思考已禁用 |
glm-5.3 |
low(低)、high(高)、max(最大);deep 是 max 的别名 | max(最大) | 低努力程度;思考已启用 |
deepseek-v4-pro、deepseek-v4-flash、deepseek-flash |
low(低)、high(高)、max(最大) | high(高);显式的 xdeep 会选择 max | 思考已禁用 |
MiniMax-M3 |
现有的思考 / 无开关;没有努力程度档位 | 提供商的思考默认值 | 思考已禁用 |
MiniMax-M2.7 |
没有努力程度或禁用开关 | 始终开启的思考 | 始终开启的思考 |
显式的模型/代理推理选项和所选变体会覆盖自动努力程度策略。否定的推理能力声明会阻止自动努力程度变体和这些辅助控件。普通请求没有选择努力程度时,GLM 和 DeepSeek 保持提供商的默认。辅助请求使用自己的控件,而不改变用户已保存的选择。
Qwen 选项冲突与强制工具
Qwen 3.8 接受 reasoning_effort 或 thinking_budget 之一,绝不同时接受两者。显式的思考预算会抑制自动努力程度选择。当合并后的选项同时包含努力程度和预算时,努力程度优先。high 和 max 规范化为 xhigh,minimal 规范化为 low,并且 none 会禁用思考。阿里云方案路由保留其现有的 token 预算上限,包括未选择努力程度时的有界回退。这些映射遵循 阿里云 Chat API。
Qwen 思考模式拒绝强制工具调用。对于 tool_choice: required,AX Code 会为该请求禁用思考,并移除不兼容的努力程度、预算和保留选项。随后的自动工具回合会恢复所选的努力程度。现有的 DeepSeek 必需工具处理也会为该请求保持思考禁用,正如其 思考模式 API 所要求的。
推理连续性
Qwen、GLM 和 DeepSeek 通过 reasoning_content 重放已存储的推理。MiniMax M2.7/M3 的 Chat 请求使用 reasoning_split: true,以便 SDK 单独收到推理并能精确重放。这避免把网关推理转换成私有 GPU 部署所用的 <mm:think> 格式。显式的 reasoning_split: false 保留原生的 <think> 重放。Anthropic 签名和私有 GPU 标签处理保留其现有路径。见 MiniMax 的 Chat API。
GLM 的跨回合保留思考在符合条件的长代理请求期间,仍然通过提供商 options.preserveThinking: true 选择加入。它会发送 thinking: { type: "enabled", clear_thinking: false }。只对来自同一模型的完整、未修改历史启用它;它可能增加计费输入。普通的工具回合重放不需要这项选择加入。Z.ai 记录了保留要求。GLM 5.3 始终推理,因此辅助请求使用低努力程度,而不是禁用它。GLM 5.3 控件。
自定义部署
网关可能用不同的参数方言暴露同一个模型 ID。要为某个模型保留先前的转换行为,请在该模型的提供商配置上设置 options.nativeReasoning: false:
{
"provider": {
"my-gateway": {
"models": {
"glm-5.3": {
"options": { "nativeReasoning": false }
}
}
}
}
}
这是本地配置档的选择退出,不是禁用模型思考的命令。它会在发送请求之前被移除。现有的显式配置变体仍然是用户控件。原生 DeepSeek SDK 不会从这个配置档获得努力程度变体,因为它已安装的序列化器不支持它们。
API 验收、工具延续和确切的客户端重放是兼容性证据。它们不能证明上游会尊重每一个努力程度提示、其缓存会更常命中,或编码质量或速度会提高。任务级比较请使用配套的 控制框架评估。