AX Code holen · KostenlosDokumentation

Diese Seite ist eine Übersetzung der englischen Dokumentation. Befehle, Bezeichner und Beispiele bleiben unverändert. Runtime 7.24.4 · SDK 2.6.7. Englische Fassung

Auto-Route – automatische Weiterleitung

Status: Aktiv Geltungsbereich: aktueller Stand Zuletzt geprüft: 2026-10-10 Verantwortlich: ax-code runtime

Die Auto-Route steuert zwei unabhängige Arten der Weiterleitung in AX Code:

  1. Schlüsselwort-Weiterleitung — standardmäßig aktiv. Sie wechselt den Agenten, wenn eine Nachricht zu Schlüsselwörtern oder Mustern einer Fachrolle passt. Sie löst in unter 1ms aus und braucht keinen LLM-Aufruf. Sie wird übersprungen, wenn die Weiterleitung ausdrücklich abgeschaltet ist, Sie ausdrücklich einen Agenten nennen oder die Nachricht eine synthetische Fortsetzung ist, die den aktuellen Agenten beibehält.

  2. Komplexitäts-Weiterleitung — optional, eingeschaltet über den Schalter der Auto-Route. Ein leichter LLM-Aufruf stuft jede Nachricht als Komplexität low, medium oder high ein. Nachrichten der Komplexität low bedient automatisch das ausdrücklich konfigurierte small_model und senkt so die Latenz bei einfachen Fragen.

Standardmäßig ist die Auto-Route aus. Die Komplexitäts-Weiterleitung ist dann deaktiviert. Die Schlüsselwort-Weiterleitung ist von diesem Schalter getrennt und bleibt standardmäßig aktiv, sofern die Konfiguration sie nicht abschaltet oder eine ausdrückliche Agentenwahl sie umgeht.

Schnellstart

Schalten Sie in der TUI um:

  • Geben Sie /smart-llm in die Eingabe ein, oder
  • Drücken Sie Ctrl+P und suchen Sie nach „Auto-Route“, oder
  • Klicken Sie auf die Anzeige Auto-Route an/aus in der Statusleiste

Die Statusleiste zeigt den aktuellen Zustand:

  • Auto-Route an (violetter Text) — die Komplexitäts-Weiterleitung ist aktiv
  • Auto-Route aus (weißer Text) — die Komplexitäts-Weiterleitung ist deaktiviert (Voreinstellung)

Die Einstellung bleibt über Sitzungen hinweg in ax-code.json erhalten.

So funktioniert es

Maßgebliche Quelle

Diese Seite fasst das Verhalten für Anwender zusammen. Wenn sich das Verhalten ändert, prüfen Sie die Dokumentation anhand dieser Stellen:

  • packages/ax-code/src/agent/router.ts für die Regeln der Schlüsselwort-Weiterleitung und classifyComplexity().
  • packages/ax-code/src/session/prompt.ts dafür, wann die Schlüsselwort-Weiterleitung übersprungen wird und wann die Einstufung der Komplexität läuft.
  • packages/ax-code/src/server/routes/smart-llm.ts für Voreinstellung, Umgebung, Konfiguration und das Speichern.
  • packages/ax-code/src/config/schema.ts für Felder der Weiterleitungskonfiguration und Hinweise zur Abkündigung.
  • packages/ax-code/src/cli/tui/app.tsx für Namen von Slash-Befehlen, Aliase, Beschriftungen und Aktionen der Statusleiste.
  • packages/ax-code/test/agent/router.test.ts und die Synchronisationstests der TUI für das erwartete Aktivierungsverhalten.

Beschreiben Sie die Schlüsselwort-Weiterleitung und die Komplexitäts-Weiterleitung über ein schnelles Modell nicht als ein einziges Merkmal. Sie sind absichtlich getrennt.

Schlüsselwort-Weiterleitung (standardmäßig aktiv, <1ms)

Benutzernachrichten werden mit Schlüsselwort- und Regex-Mustern jedes Fachagenten abgeglichen (security, architect, debug, perf, devops, test). Liegt eine Übereinstimmung bei einem Vertrauen von ≥ 0.4, kann der Agent sofort wechseln. Es erfolgt kein LLM-Aufruf. Dieser Weg ist vom Schalter der Auto-Route unabhängig, wird aber übersprungen, wenn die Weiterleitung abgeschaltet ist, Sie ausdrücklich einen Agenten nennen oder die aktuelle Runde einen bestehenden Agenten für eine synthetische Fortsetzung beibehält.

Komplexitäts-Weiterleitung (nur Auto-Route, etwa 200-500ms)

Wenn die Auto-Route aktiv ist, geht jede Nachricht über classifyComplexity() an ein schnelles und günstiges Modell. Dieser LLM-Aufruf liefert eine Schätzung der Komplexität (low / medium / high):

  • Nachrichten der Komplexität low nutzen automatisch das ausdrücklich konfigurierte small_model
  • Nachrichten medium und high nutzen wie gewohnt das Standardmodell
  • Übersprungen, wenn small_model fehlt oder nicht verfügbar ist
  • Timeout von 1.5 Sekunden — stiller Rückfall, wenn das LLM langsam oder nicht verfügbar ist
  • Alle Fehler werden still abgefangen und blockieren Sie nie

Die Komplexitäts-Weiterleitung ist von der Weiterleitung der Agenten unabhängig. Sie stuft nicht ein, welcher Fachagent zu nutzen ist. Das erledigt vollständig die Schlüsselwort-Weiterleitung.

Wobei die Auto-Route hilft

Szenario Ohne Auto-Route Mit Auto-Route
„Was tut diese Variable?“ Volles Modell verwendet Komplexität low → schnelles Modell
„Alle Exporte in dieser Datei auflisten“ Volles Modell verwendet Komplexität low → schnelles Modell
„Nach Schwachstellen suchen“ Schlüsselwort leitet zu security Gleich — die Schlüsselwort-Weiterleitung löst immer aus
„Das Auth-Modul über 8 Dateien umbauen“ Standardmodell Komplexität high → Standardmodell
„Diese Funktion ist träge“ Keine Schlüsselwort-Übereinstimmung, keine Weiterleitung low/medium → passende Modellstufe

Die Schlüsselwort-Weiterleitung wählt den Fachagenten anhand technischer Schlüsselwörter. Die Komplexitäts-Weiterleitung wählt die passende Modellstufe danach, wie viel Reasoning die Antwort braucht.

Nachteile und Hinweise

Latenz

Die Komplexitäts-Weiterleitung fügt Nachrichten, die den Einstufungsaufruf auslösen, 200-500ms hinzu. Die Schlüsselwort-Weiterleitung, die immer aktiv ist, bleibt unberührt und antwortet unabhängig davon in <1ms.

Ein kleines Modell ist erforderlich

Die Komplexitäts-Weiterleitung verlangt eine ausdrückliche Konfiguration von small_model. AX Code leitet keinen Helfer aus Modellnamen ab und verschiebt eine nicht verfügbare Festlegung nicht zu einem anderen Anbieter. Ohne nutzbaren Helfer wird die Einstufung übersprungen, und das gewählte Primärmodell bleibt erhalten. Siehe Modellauswahl und Wiederherstellung.

Token-Verbrauch

Jeder Einstufungsaufruf nutzt ungefähr 100-200 Eingabe-Token und 10-20 Ausgabe-Token. Das bleibt gegenüber dem anschließenden Hauptaufruf des LLM gering.

Kein Ersatz für die ausdrückliche Auswahl

Die Auto-Route verbessert die automatische Wahl der Modellstufe, kann aber nicht allein anhand natürlicher Sprache zu Fachagenten leiten. Bei kritischen Aufgaben, bei denen der passende Fachagent zählt, ist die ausdrückliche Wahl über die Agentenauswahl oder die Erwähnung @agent verlässlicher.

Konfiguration

Umschalten in der TUI

Verwenden Sie /smart-llm oder die Befehlspalette (Ctrl+P → „Auto-Route ein- oder ausschalten“). Die Änderung wirkt sofort und wird in ax-code.json Ihres Projekts gespeichert.

Konfigurationsdatei

{
  "routing": {
    "llm": true
  }
}

Umgebungsvariable

AX_CODE_SMART_LLM=true ax-code

Die Umgebungsvariable überschreibt die Einstellung in der Konfigurationsdatei.

Auto-Route und weitere Einstellungen

Einstellung Zusammenspiel
Autonomer Modus Die Auto-Route arbeitet unabhängig. Die Weiterleitung der Agenten und die Einstufung der Komplexität geschehen vor den Berechtigungsprüfungen.
Sandbox-Modus Kein Zusammenspiel. Die Auto-Route beeinflusst nur, welcher Agent und welche Modellstufe gewählt werden, und nicht, was der Agent tun darf.
Modellauswahl Nachrichten der Komplexität low nutzen das ausdrücklich konfigurierte small_model, wenn die Auto-Route an ist und kein Modell ausdrücklich festgelegt ist.
Ausführungsmodi Die hybride Platzierung (modes.default: "hybrid") ist getrennt: sie wählt lokal oder Cloud. Siehe Ausführungsmodi.

Wann Sie die Auto-Route einschalten

Einschalten, wenn:

  • Sie einfache Fragen automatisch an ein günstigeres und schnelleres Modell leiten möchten
  • Sie die Token-Kosten bei Austausch mit geringer Komplexität senken möchten
  • Sie mit einem Anbieter arbeiten, der ein verlässliches kleines oder Flash-Modell bereitstellt

Ausgeschaltet lassen, wenn:

  • Sie bei jeder Nachricht ohne zusätzliche Latenz arbeiten möchten
  • Sie offline oder mit unzuverlässigem Netzwerk arbeiten
  • Sie den Token-Verbrauch möglichst klein halten möchten
  • Sie ein Modell immer ausdrücklich festlegen