AX Code holen · KostenlosDokumentation

Diese Seite ist eine Übersetzung der englischen Dokumentation. Befehle, Bezeichner und Beispiele bleiben unverändert. Runtime 7.24.4 · SDK 2.6.7. Englische Fassung

Bewährte Praxis für die Weiterleitung über mehrere Modelle

Status: Aktiv Geltungsbereich: öffentlich, aktueller Stand Zuletzt geprüft: 2026-09-13 Verantwortlich: ax-code runtime

Dieser Leitfaden beschreibt den empfohlenen Weg, ax-code mit einem hochwertigen Reasoning-Modell und günstigeren Hilfsmodellen desselben Anbieters zu betreiben.

Grundsatz

Verwenden Sie das teure Modell für Arbeit mit dichtem Reasoning und günstige Modelle für mechanische oder nur lesende Arbeit. Die eigentliche Ersparnis kommt aus der Filterung des Kontexts: Das hochwertige Modell sieht nur destillierten Kontext, den günstigere Modelle oder Unteragenten vorbereitet haben.

Schicht Modellklasse Typische Agenten / Aufgaben
Arbeiter / Ausführender Verbundene Flash-SKU, wenn verfügbar (z. B. DeepSeek Flash) nicht festgelegte Sitzung, build, general, scout, test, devops, perf
Berater / Reasoning Stärkeres verbundenes Modell (z. B. DeepSeek V4 Pro) plan, architect, security, debug
Günstig / nur lesende Hilfe Dieselbe Flash-SKU explore, compaction, Titel, Rückblicke, Klassifikation geringer Komplexität

Legen Sie verbundene Kennungen provider/model fest. Deaktivierte anbietereigene Plan-Kennungen (alibaba-token-plan, deepseek, zai-coding-plan, minimax-coding-plan) lassen sich weiterhin über die SKU auflösen, aber jeder Aufruf versucht zuerst den deaktivierten Anbieter und warnt. Qwen 3.8 Max ist eine gültige ausdrückliche Wahl, nicht die Produkt- oder Beispielvoreinstellung; ohne config.model durchläuft die implizite Voreinstellung verbundene Kataloge in dieser Reihenfolge: deepseek-flash, danach glm-5.3-flash, danach qwen3.8-flash, danach MiniMax-M3, danach grok-4.6, danach claude-sonnet-5, danach gpt-6, danach gemini-3.8-flash und zuletzt qwen3.8-27b.

Konfigurationsvorlage

Siehe ax-code.json.example im Stamm des Repositorys für eine konkrete Voreinstellung DeepSeek Flash mit Pro auf Reasoning-Agenten.

Hilfsmodelle der Codex CLI

Die Verfügbarkeit von Codex-Modellen hängt von der Anmeldemethode und vom Client des Kontos ab, nicht nur von den Text- oder Werkzeugfähigkeiten des Katalogs. AX Code leitet daher kein kleines Modell codex-cli aus Namen oder Familienmetadaten ab. Ohne ein ausdrückliches Modell small_model oder ein Modell des Verdichtungsagenten verwendet die Verdichtung das Sitzungsmodell.

Wenn Sie ein Hilfsmodell konfigurieren, prüfen Sie, dass es mit derselben Codex-Anmeldung funktioniert. Eine ausdrückliche Ablehnung von Codex, dass ein Modell mit einem ChatGPT-Konto nicht unterstützt wird, erlaubt der Verdichtung einen einmaligen Versuch mit dem Sitzungsmodell und überspringt andere kleine Modelle. Der abgelehnte Versuch bleibt in der Sitzungshistorie. Andere Fehler bei Authentifizierung, Abrechnung, Validierung, Abbruch und Kontextüberlauf behalten ihre bestehende Behandlung; der Datenschutzschutz des lokalen Anbieters gilt weiterhin.

Entfernen Sie bei einer betroffenen älteren Installation eine unverträgliche Überschreibung small_model oder agent.compaction.model und legen Sie agent.compaction.model ausdrücklich auf ein Modell fest, das mit diesem Codex-Konto bereits geprüft wurde. Nur das sichtbare Sitzungsmodell zu ändern überschreibt ein getrennt festgelegtes Verdichtungsmodell nicht.

Regeln für die automatische Weiterleitung nach Aufgabentyp

Leiten Sie nicht alle geringwertigen Aufgaben automatisch an ein günstiges Modell. Teilen Sie sie nach den Kosten eines Fehlschlags:

  • Sicher automatisch weiterzuleiten (nur lesend oder von Menschen prüfbar):
    • Erkundung des Repositorys, Sichtung per grep oder Suche, Klassifikation von Dateien
    • Zusammenfassung von Code, Zusammenfassung von Protokollen, Erklärung von Code
    • Kontext für das hochwertige Modell vorbereiten
    • Dokumentation
  • Nur mit ausdrücklicher Zustimmung (mechanisch prüfbar, kann aber Verhaltensänderungen verbergen):
    • Boilerplate, Lint-Korrekturen
  • Niemals standardmäßig automatisch weiterleiten (stille Fehler sind teuer):
    • Unit-Tests
    • Umbenennen und Refactoring
    • einfaches SQL
    • API-Wrapper
    • einfaches CRUD

Die letzte Gruppe sollte auf dem Sitzungsmodell bleiben, sofern Sie nicht ausdrücklich ein günstigeres Modell festlegen.

Betriebshandbuch

  1. Starten Sie nicht triviale Aufgaben im Modus plan, damit der Berater den Entwurf prüft, bevor der Arbeiter Code schreibt.
  2. Wenn der Arbeiter in einer Schleife läuft oder die Prüfung zweimal nicht besteht, wechseln Sie mit dem fehlschlagenden Signal zu debug.
  3. Verwenden Sie council für eine unabhängige Diagnose, wenn zwei Korrekturen plausibel sind, nicht um die Aufgabe abzuschließen.
  4. Heben Sie manuelle Modellwechsel für seltene, reasoning-lastige Züge auf; wechseln Sie danach zurück.

Bekannte Grenzen von ax-code

  • Provider.getSmallModel() liefert undefined für Anbieter, deren Katalog weder eine stufentragende family kennzeichnet noch die fest hinterlegten Prioritätslisten trifft; Hilfsaufrufe fallen dann auf das Sitzungsmodell zurück (protokolliert als „no small model for provider“).
  • Es gibt keine Eskalation mitten im Lauf von einem feststeckenden Arbeiter zu einem stärkeren Modell.