Diese Seite ist eine Übersetzung der englischen Dokumentation. Befehle, Bezeichner und Beispiele bleiben unverändert. Runtime 7.24.4 · SDK 2.6.7. Englische Fassung
Modellauswahl und Wiederherstellung
Status: Aktiv Geltungsbereich: aktueller Stand Zuletzt geprüft: 2026-10-10 Verantwortlich: ax-code runtime
AX Code behält genaue Auswahlen von Anbieter und Modell. Einen Anbieter zu verbinden fügt ihn keinem automatischen Wiederherstellungspool hinzu. Ohne konfigurierten Rückfall wiederholen vorübergehende Fehler das gewählte Ziel innerhalb der bestehenden Wiederholungsgrenze und stoppen dann.
Einen geordneten Rückfall konfigurieren
Setzen Sie llm_routing.fallback in der Benutzerkonfiguration, in einer eigenen Konfiguration, die über
AX_CODE_CONFIG gewählt wird, oder in ausdrücklichem AX_CODE_CONFIG_CONTENT. Ziele sind genaue Paare;
Modellkennungen dürfen Schrägstriche enthalten. Zum Beispiel:
{
"model": "my-gateway/openai/gpt-oss-120b",
"llm_routing": {
"fallback": [
{ "providerID": "my-gateway", "modelID": "my-backup-model" },
{ "providerID": "my-other-provider", "modelID": "my-approved-model" }
]
}
}
Ersetzen Sie diese Beispiele durch genaue Kennungen Ihrer konfigurierten Anbieter. Die Liste erlaubt bis zu acht verschiedene Ziele. Leer oder fehlend bedeutet, dass sich kein Ziel ändert. Projekt- und Fernkonfiguration können Benutzerfreigaben einschränken, sie aber nicht hinzufügen oder umordnen. Verwaltete Einschränkungen bilden eine letzte Obergrenze. Fehlt das konfigurierte nächste Ziel, stoppt die Wiederherstellung; AX Code setzt keinen anderen Katalogeintrag ein.
Gewöhnliche vorübergehende Ratengrenzen, erkannte Überlast und Serverfehler können diese Liste nach Wiederholungen desselben Ziels weiter durchlaufen. Fehler bei Authentifizierung, Berechtigung, dauerhaftem Kontingent und ungültigen Anfragen erlauben keinen Wechsel. Sitzungen lokaler Anbieter wandern nicht automatisch zu entfernter Inferenz. Ein Abbruch stoppt die Folge. Eine Wiederherstellung, nachdem die aktuelle Anfrage Ausgabe veröffentlicht oder ein Werkzeug startet, stoppt ebenfalls und bewahrt den teilweisen Fortschritt, statt Wirkungen erneut abzuspielen.
Der Prozessor erlaubt normalerweise fünf Wiederholungen desselben Ziels nach dem ersten Versuch; Fehler an der Nebenläufigkeitsgrenze haben eine Grenze von acht Wiederholungen. Schutzschalter des Anbieters und äußere Fehlergrenzen können früher stoppen. Erfolgreiche Schritte der Werkzeugschleife sind neue Anfragen, keine Wiederholungen früherer Arbeit. Wiederholungen des AI SDK sind an gesteuerten Stellen der direkten Erzeugung deaktiviert. Interne Versuche externer CLIs und Gateways können undurchsichtig bleiben.
Hilfsarbeit und bestehende Konfiguration
Ohne small_model erben Titel, Rückblick und Verdichtung das primäre Modell.
Ein ausdrückliches small_model oder ein rollenspezifisches Agentenmodell wählt weiterhin genau dieses
Ziel. Ungültige Festlegungen scheitern, statt zu einem anderen Anbieter oder Modell zu wechseln. Optionale
Arbeit an Titel und Rückblick behält ihr Verhalten für lokalen Titel bzw. Überspringen. Die Verdichtung bewahrt das
Transkript, wenn sie scheitert, und wechselt Modelle nur über die konfigurierte Wiederherstellung.
Konfigurierte primäre Modelle, Festlegungen von Aufgabe, Agent und Befehl sowie gespeicherte jüngere Auswahlen
bleiben ebenfalls genau. Entfernen oder korrigieren Sie eine nicht verfügbare Festlegung ausdrücklich. Kopflose Läufe
ohne konfigurierte oder jüngere Auswahl erfordern --model. Die sichtbare Modellauswahl
kann Empfehlungen anbieten, aber diese Vorschläge werden nicht zu einer Wiederherstellungsliste.
Der optionale Komplexitätsklassifikator verlangt ein ausdrückliches Hilfsmodell; ohne eines wird die Klassifikation übersprungen. Er ist am angeforderten Anbieter verankert, wenn ein primäres Modell angegeben ist. Ausdrückliche primäre Wahlen überstehen das Routing nach Agententhema.
Die wirksame Konfiguration prüfen
ax-code debug routing
ax-code debug routing --model my-gateway/openai/gpt-oss-120b
Dies gibt das genaue primäre Modell, den geordneten Rückfall, die Hilfsauswahl, die Agentenfestlegungen und die Wiederholungsgrenze aus. Es sendet keine Modellanfrage und prüft nicht die Verfügbarkeit von Modellen. Das gewöhnliche Laden der Konfiguration kann konfigurierte ferne Einstellungen abrufen. Das ist eine Erklärung der Konfiguration, keine Rekonstruktion früheren Gateway-Verhaltens.
Benutzernachrichten zeichnen auf, ob die Auswahl aus einer Anfrage, einer Agentenfestlegung,
dem Routing nach Komplexität oder Hybrid oder aus Voreinstellungen von Sitzung und Konfiguration kam. Diese Quelle beschreibt den lokalen
Eingang; request belegt nicht, wer einen API-Client bedient hat. Nachweise der Anfrage
zeichnen den gewählten Zweck und das Ziel auf. Vom Modell erzeugte Selbstbeschreibungen und
Modellnamen im Speicher oder in Werkzeugbeispielen sind keine Routing-Nachweise. AX Trust und
externe Anbieter behalten die Verantwortung für Routing und Autorisierung upstream.