Bu sayfa İngilizce belgenin çevirisidir. Komutlar, tanımlayıcılar ve örnekler aynıdır. Çalışma zamanı 7.24.4 · SDK 2.6.7. İngilizce kaynak
Güncel model akıl yürütme denetimleri
Durum: Etkin
Kapsam: güncel durum
Son inceleme: 2026-09-14
Sahip: ax-code runtime
AX Code, akıl yürütme denetimlerini yukarı akış model kimliği ve SDK protokolüyle seçer. Bu profiller aşağıdaki tam kimlikler için OpenAI uyumlu Chat rotalarını kapsar. Mevcut yerel SDK, özel GPU, AX Engine ve kısıtlı ağ geçidi davranışını korurlar.
| Model kimlikleri | Kullanılabilir çaba | Otonom / yinelenen araç başarısızlığı | Yardımcı istekler |
|---|---|---|---|
qwen3.8-max, qwen3.8-flash |
low, medium, xhigh; high, xhigh için mevcut bir takma addır | xhigh | Düşünme kapalı |
glm-5.3 |
low, high, max; deep, max için takma addır | max | Düşük çaba; düşünme açık |
deepseek-v4-pro, deepseek-v4-flash, deepseek-flash |
low, high, max | high; açık xdeep max seçer | Düşünme kapalı |
MiniMax-M3 |
Mevcut thinking / none anahtarı; çaba düzeyi yok | Sağlayıcı düşünme varsayılanı | Düşünme kapalı |
MiniMax-M2.7 |
Çaba veya kapatma anahtarı yok | Her zaman açık düşünme | Her zaman açık düşünme |
Açık model/ajan akıl yürütme seçenekleri ve seçilen varyantlar otomatik çaba ilkesini geçersiz kılar. Olumsuz bir akıl yürütme yetenek bildirimi otomatik çaba varyantlarını ve bu yardımcı denetimleri engeller. GLM ve DeepSeek, olağan istekler bir çaba seçmediğinde sağlayıcının varsayılanını korur. Yardımcı istekler kullanıcının kayıtlı seçimini değiştirmeden kendi denetimlerini kullanır.
Qwen seçenek çatışmaları ve zorlanmış araçlar
Qwen 3.8 ya reasoning_effort ya da thinking_budget kabul eder, ikisini birden asla. Açık bir düşünme bütçesi otomatik çaba seçimini bastırır. Birleştirilmiş seçenekler hem çaba hem bütçe içerdiğinde çaba kazanır. high ve max, xhigh değerine normalize olur, minimal ise low değerine, ve none düşünmeyi kapatır. Alibaba plan rotaları, çaba seçilmediğinde sınırlı geri dönüş dahil mevcut belirteç bütçesi tavanını korur. Bu eşlemeler Alibaba Chat API belgesini izler.
Qwen düşünme modu zorlanmış araç çağrılarını reddeder. tool_choice: required için AX Code o istekte düşünmeyi kapatır ve uyumsuz çaba, bütçe ve koruma seçeneklerini kaldırır. Sonraki otomatik araç turları seçilen çabayı sürdürür. Mevcut DeepSeek zorunlu araç işlemesi de, thinking-mode API belgesinin gerektirdiği gibi, o istekte düşünmeyi kapalı tutar.
Akıl yürütme sürekliliği
Qwen, GLM ve DeepSeek saklanan akıl yürütmeyi reasoning_content üzerinden yeniden oynatır. MiniMax M2.7/M3 Chat istekleri reasoning_split: true kullanır; böylece SDK akıl yürütmeyi ayrı alır ve tam olarak yeniden oynatabilir. Bu, ağ geçidi akıl yürütmesini özel GPU dağıtımlarının kullandığı <mm:think> biçimine dönüştürmekten kaçınır. Açık reasoning_split: false, yerel <think> yeniden oynatmasını korur. Anthropic imzaları ve özel GPU etiket işlemesi mevcut yollarını korur. Bkz. MiniMax Chat API.
GLM’in turlar arası korunan düşünmesi, uygun uzun ajan istekleri sırasında sağlayıcı options.preserveThinking: true üzerinden isteğe bağlı kalır. thinking: { type: "enabled", clear_thinking: false } gönderir. Yalnızca aynı modelden tam ve değiştirilmemiş geçmiş için açın; faturalanan girdiyi artırabilir. Olağan araç turu yeniden oynatması bu tercihi gerektirmez. Z.ai koruma gereksinimlerini belgeler. GLM 5.3 her zaman akıl yürütür; bu yüzden yardımcı istekler düşünmeyi kapatmak yerine düşük çaba kullanır. GLM 5.3 denetimleri.
Özel dağıtımlar
Bir ağ geçidi aynı model kimliğini farklı bir parametre lehçesiyle sunabilir. Bir model için önceki dönüşüm davranışını korumak üzere o modelin sağlayıcı yapılandırmasında options.nativeReasoning: false ayarlayın:
{
"provider": {
"my-gateway": {
"models": {
"glm-5.3": {
"options": { "nativeReasoning": false }
}
}
}
}
}
Bu, model düşünmesini kapatma komutu değil, yerel bir profil vazgeçişidir. İstek gönderilmeden önce kaldırılır. Mevcut açıkça yapılandırılmış varyantlar kullanıcı denetimi olarak kalır. Yerel DeepSeek SDK bu profilden çaba varyantı kazanmaz; kurulu serileştiricisi bunları desteklemez.
API kabulü, araç sürdürmesi ve tam istemci yeniden oynatması uyumluluk kanıtıdır. Bir yukarı akışın her çaba ipucunu onurlandırdığını, önbelleğinin daha sık isabet ettiğini veya kodlama kalitesi ya da hızının arttığını kanıtlamazlar. Görev düzeyinde karşılaştırmalar için eşleştirilmiş koşum değerlendirmesi kullanın.