AX Code’u edinin · ÜcretsizBelgeler

Bu sayfa İngilizce belgenin çevirisidir. Komutlar, tanımlayıcılar ve örnekler aynıdır. Çalışma zamanı 7.24.4 · SDK 2.6.7. İngilizce kaynak

Güncel model akıl yürütme denetimleri

Durum: Etkin

Kapsam: güncel durum

Son inceleme: 2026-09-14

Sahip: ax-code runtime

AX Code, akıl yürütme denetimlerini yukarı akış model kimliği ve SDK protokolüyle seçer. Bu profiller aşağıdaki tam kimlikler için OpenAI uyumlu Chat rotalarını kapsar. Mevcut yerel SDK, özel GPU, AX Engine ve kısıtlı ağ geçidi davranışını korurlar.

Model kimlikleri Kullanılabilir çaba Otonom / yinelenen araç başarısızlığı Yardımcı istekler
qwen3.8-max, qwen3.8-flash low, medium, xhigh; high, xhigh için mevcut bir takma addır xhigh Düşünme kapalı
glm-5.3 low, high, max; deep, max için takma addır max Düşük çaba; düşünme açık
deepseek-v4-pro, deepseek-v4-flash, deepseek-flash low, high, max high; açık xdeep max seçer Düşünme kapalı
MiniMax-M3 Mevcut thinking / none anahtarı; çaba düzeyi yok Sağlayıcı düşünme varsayılanı Düşünme kapalı
MiniMax-M2.7 Çaba veya kapatma anahtarı yok Her zaman açık düşünme Her zaman açık düşünme

Açık model/ajan akıl yürütme seçenekleri ve seçilen varyantlar otomatik çaba ilkesini geçersiz kılar. Olumsuz bir akıl yürütme yetenek bildirimi otomatik çaba varyantlarını ve bu yardımcı denetimleri engeller. GLM ve DeepSeek, olağan istekler bir çaba seçmediğinde sağlayıcının varsayılanını korur. Yardımcı istekler kullanıcının kayıtlı seçimini değiştirmeden kendi denetimlerini kullanır.

Qwen seçenek çatışmaları ve zorlanmış araçlar

Qwen 3.8 ya reasoning_effort ya da thinking_budget kabul eder, ikisini birden asla. Açık bir düşünme bütçesi otomatik çaba seçimini bastırır. Birleştirilmiş seçenekler hem çaba hem bütçe içerdiğinde çaba kazanır. high ve max, xhigh değerine normalize olur, minimal ise low değerine, ve none düşünmeyi kapatır. Alibaba plan rotaları, çaba seçilmediğinde sınırlı geri dönüş dahil mevcut belirteç bütçesi tavanını korur. Bu eşlemeler Alibaba Chat API belgesini izler.

Qwen düşünme modu zorlanmış araç çağrılarını reddeder. tool_choice: required için AX Code o istekte düşünmeyi kapatır ve uyumsuz çaba, bütçe ve koruma seçeneklerini kaldırır. Sonraki otomatik araç turları seçilen çabayı sürdürür. Mevcut DeepSeek zorunlu araç işlemesi de, thinking-mode API belgesinin gerektirdiği gibi, o istekte düşünmeyi kapalı tutar.

Akıl yürütme sürekliliği

Qwen, GLM ve DeepSeek saklanan akıl yürütmeyi reasoning_content üzerinden yeniden oynatır. MiniMax M2.7/M3 Chat istekleri reasoning_split: true kullanır; böylece SDK akıl yürütmeyi ayrı alır ve tam olarak yeniden oynatabilir. Bu, ağ geçidi akıl yürütmesini özel GPU dağıtımlarının kullandığı <mm:think> biçimine dönüştürmekten kaçınır. Açık reasoning_split: false, yerel <think> yeniden oynatmasını korur. Anthropic imzaları ve özel GPU etiket işlemesi mevcut yollarını korur. Bkz. MiniMax Chat API.

GLM’in turlar arası korunan düşünmesi, uygun uzun ajan istekleri sırasında sağlayıcı options.preserveThinking: true üzerinden isteğe bağlı kalır. thinking: { type: "enabled", clear_thinking: false } gönderir. Yalnızca aynı modelden tam ve değiştirilmemiş geçmiş için açın; faturalanan girdiyi artırabilir. Olağan araç turu yeniden oynatması bu tercihi gerektirmez. Z.ai koruma gereksinimlerini belgeler. GLM 5.3 her zaman akıl yürütür; bu yüzden yardımcı istekler düşünmeyi kapatmak yerine düşük çaba kullanır. GLM 5.3 denetimleri.

Özel dağıtımlar

Bir ağ geçidi aynı model kimliğini farklı bir parametre lehçesiyle sunabilir. Bir model için önceki dönüşüm davranışını korumak üzere o modelin sağlayıcı yapılandırmasında options.nativeReasoning: false ayarlayın:

{
  "provider": {
    "my-gateway": {
      "models": {
        "glm-5.3": {
          "options": { "nativeReasoning": false }
        }
      }
    }
  }
}

Bu, model düşünmesini kapatma komutu değil, yerel bir profil vazgeçişidir. İstek gönderilmeden önce kaldırılır. Mevcut açıkça yapılandırılmış varyantlar kullanıcı denetimi olarak kalır. Yerel DeepSeek SDK bu profilden çaba varyantı kazanmaz; kurulu serileştiricisi bunları desteklemez.

API kabulü, araç sürdürmesi ve tam istemci yeniden oynatması uyumluluk kanıtıdır. Bir yukarı akışın her çaba ipucunu onurlandırdığını, önbelleğinin daha sık isabet ettiğini veya kodlama kalitesi ya da hızının arttığını kanıtlamazlar. Görev düzeyinde karşılaştırmalar için eşleştirilmiş koşum değerlendirmesi kullanın.