Diese Seite ist eine Übersetzung der englischen Dokumentation. Befehle, Bezeichner und Beispiele bleiben unverändert. Runtime 7.24.4 · SDK 2.6.7. Englische Fassung
Unterstützte Anbieter und Modelle
Status: Aktiv Geltungsbereich: aktueller Stand Zuletzt geprüft: 2026-09-19 Verantwortlich: ax-code runtime
Diese Seite listet die Anbietervoreinstellungen, die AX Code in den voreingestellten Einrichtungsabläufen anbietet. Maßgeblich sind die Zulassungsliste der Laufzeitanbieter in
packages/ax-code/src/provider/default-setup-providers.ts, der gebündelte Modell-Snapshot in
packages/ax-code/src/provider/models-snapshot.json, die Voreinstellungen der lokalen Laufzeit in
packages/ax-code/src/provider/local-runtime.ts und die Definitionen von AX Engine in
packages/ax-code/src/provider/ax-engine/constants.ts.
Verwenden Sie /connect in der Terminaloberfläche oder ax-code providers login <provider-id> für die interaktive Einrichtung. Kopflose Umgebungen und CI können außerdem die aufgeführten Umgebungsvariablen setzen.
Verbundene Anbieter verwalten
Die Sitzungsansicht hält eine obere Leiste mit der Sitzungskennung (Klick kopiert), dem Titel und dem Live-Status, danach einen Eintrag Anbieter mit der Zahl der Verbindungen; klicken Sie darauf oder auf verwalten, um die Anbieterverwaltung zu öffnen, die auch als Befehl /providers verfügbar ist. Von dort wählen Sie ein Modell, deaktivieren oder trennen jeden Anbieter oder springen zum vollständigen Ablauf /connect.
- Einen Schlüssel ersetzen: Wählen Sie den Anbieter in
/connectund Schlüssel ersetzen, oder führen Sieax-code providers login <provider-id>erneut aus. - Vorübergehend deaktivieren: Wählen Sie Deaktivieren in
/providersoder/connectoder führen Sieax-code providers disable <provider-id>aus. Das fügt den Anbieter zudisabled_providersin der globalen Konfiguration hinzu und behält die gespeicherten Zugangsdaten. Deaktivierte Anbieter bleiben in/providersund unter Deaktiviert in/connectsichtbar und lassen sich mit Aktivieren oderax-code providers enable <provider-id>wieder einschalten. - Dauerhaft trennen: Wählen Sie Trennen in
/providersoder/connectoder führen Sieax-code providers logout <provider-id>aus — das löscht die gespeicherte Zugangsangabe ausauth.json.
Kataloge gehosteter Modelle sind mit jeder Veröffentlichung von AX Code gebündelt und auf nutzbare Fähigkeiten eines Coding-Agenten gefiltert. Führen Sie
ax-code models <provider-id> aus, um die maßgeblichen Modellkennungen Ihrer installierten Version zu sehen; das rohe Register und kopierte
Weblisten können Modelle enthalten, die AX Code verbirgt, weil ihnen Textausgabe oder Werkzeugaufrufe fehlen. Eine Anbietervoreinstellung bedeutet nicht,
dass jedes Modell kostenlos oder auf jedem Konto verfügbar ist.
Laufzeitwahl
Ein Modell ohne Version wählen
Sowohl die TUI als auch ax-code run akzeptieren diese Familiennamen --model ohne Berücksichtigung der Großschreibung:
| Familie | Modell |
|---|---|
deepseek |
deepseek-flash |
glm |
glm-5.3-flash |
qwen |
qwen3.8-flash |
Zum Beispiel öffnet ax-code --model glm die TUI mit GLM Flash, und
ax-code run --model qwen -- "Review this change" fordert Qwen Flash an.
Setzen Sie den Prompt nach -- (oder übergeben Sie --prompt / --prompt-file); --file hängt
Dateien an und ist keine Prompt-Datei. ax-code models listet nutzbare Kennungen provider/model.
Familiennamen werden über den nativen Anbieter oder ein verbundenes Gateway aufgelöst, das
dasselbe Modell bereitstellt. Sie können den Anbieter auch nennen: --model my-gateway/glm.
Verwenden Sie eine vollständige Kennung wie my-gateway/glm-5.3, um eine bestimmte Version oder Stufe anzufordern.
--model wegzulassen bewahrt konfigurierte, Agenten-, Sitzungs- und jüngere Modellwahlen.
Wenn keine nutzbare Wahl vorliegt, beginnt die gemeinsame Rückfallreihenfolge mit DeepSeek Flash,
dann GLM Flash, dann Qwen Flash über verbundene Anbieter. Die Anbietereinrichtung hat eigene
Voreinstellungen: Alibaba Coding Plan verwendet qwen3-coder-plus; Alibaba Token Plan verwendet
qwen3.8-flash.
Eine Laufzeit verbinden
Die Auswahl in /connect ist geordnet: Cloud-API-Anbieter, CLI-Anbieter,
AX-Engine-Laufzeit, Lokale LLM-Laufzeit, Private GPU-Cloud und AX Trust.
Die AX-Engine-Laufzeit öffnet die Auswahl lokaler Modelle und die Laufzeitverwaltung direkt.
Die lokale LLM-Laufzeit listet diese Auswahl in dieser Reihenfolge:
| Menüoption | Anbieterkennung | Voreingestellter Endpunkt | Umgebungsvariable des Hosts |
|---|---|---|---|
| Ollama | ollama |
http://localhost:11434/v1 |
OLLAMA_HOST |
| LMStudio | lmstudio |
http://localhost:1234/v1 |
LMSTUDIO_HOST |
| MTPLX | mtplx |
http://localhost:8000/v1 |
MTPLX_HOST |
| oMLX | omlx |
http://localhost:8000/v1 |
OMLX_HOST |
| AX-Studio | ax-studio |
http://localhost:18080/v1 |
AX_STUDIO_HOST |
| Weitere | local-llm |
Geben Sie Ihren mit OpenAI kompatiblen Endpunkt ein | LOCAL_LLM_HOST |
Die Voreinstellungen für MTPLX und oMLX sind im Quell-Checkout verfügbar; gepackte Binärdateien von v7.19.3 enthalten sie nicht. Siehe Einrichtung von MTPLX und oMLX zur Konfiguration der Werkzeugfähigkeit, zur optionalen Authentifizierung und zum gemeinsamen Vorbehalt des voreingestellten Ports.
Starten Sie Ihren lokalen Server, wählen Sie seinen Menüeintrag und bestätigen oder bearbeiten Sie den Endpunkt.
AX Code ergänzt /v1, wenn es fehlt. Weitere speichert einen konfigurierbaren Endpunkt unter
local-llm; wählen Sie ihn erneut, um den Endpunkt zu ändern. LMStudio und Weitere verwenden den
bestehenden lokalen Einrichtungsablauf ohne Abfrage eines API-Tokens. LM Studio dokumentiert seinen
Endpunkt für die Modellliste.
Einrichtungsentscheidungen respektieren enabled_providers und disabled_providers. Die Auswahl nur zu öffnen
aktiviert oder prüft diese lokalen Server nicht. Ermittelte externe
lokale Modelle behalten konservative Fähigkeitsvoreinstellungen; Modelle müssen Werkzeugaufrufe
unterstützen, um für Abläufe eines Coding-Agenten wählbar zu sein.
Cloud-API-Anbieter
Diese Anbieter rufen gehostete APIs oder gehostete Endpunkte von Kontenplänen auf.
| Anbieterkennung | Anzeigename | Umgebungsvariablen für Zugangsdaten | Hinweis |
|---|---|---|---|
google |
GOOGLE_API_KEY, GOOGLE_GENERATIVE_AI_API_KEY, GEMINI_API_KEY |
im Katalog | |
deepseek |
DeepSeek | DEEPSEEK_API_KEY |
im Katalog |
meta |
Meta (Muse Spark) | MODEL_API_KEY, META_MODEL_API_KEY |
im Katalog |
groq |
GroqCloud | GROQ_API_KEY |
im Katalog |
openrouter |
OpenRouter | OPENROUTER_API_KEY |
im Katalog |
huggingface |
Hugging Face | HF_TOKEN |
im Katalog |
unorouter |
UnoRouter | UNOROUTER_API_KEY |
im Katalog |
alibaba-coding-plan |
Alibaba Coding Plan | ALIBABA_CODING_PLAN_INTL_API_KEY, ALIBABA_CODING_PLAN_API_KEY |
im Katalog |
alibaba-coding-plan-cn |
Alibaba Coding Plan (China) | ALIBABA_CODING_PLAN_CN_API_KEY, ALIBABA_CODING_PLAN_API_KEY |
im Katalog |
alibaba-token-plan |
Alibaba Token Plan | ALIBABA_TOKEN_PLAN_INTL_API_KEY, ALIBABA_TOKEN_PLAN_API_KEY |
im Katalog |
alibaba-token-plan-cn |
Alibaba Token Plan (China) | ALIBABA_TOKEN_PLAN_CN_API_KEY, ALIBABA_TOKEN_PLAN_API_KEY |
im Katalog |
github-copilot |
GitHub Copilot | GITHUB_TOKEN |
im Katalog |
zai |
Z.AI | ZHIPU_API_KEY |
im Katalog |
zai-coding-plan |
Z.AI Coding Plan | ZHIPU_API_KEY |
im Katalog |
minimax-coding-plan |
MiniMax Token Plan | MINIMAX_TOKEN_PLAN_API_KEY, MINIMAX_API_KEY |
im Katalog |
minimax-cn-coding-plan |
MiniMax Token Plan (China) | MINIMAX_TOKEN_PLAN_CN_API_KEY, MINIMAX_API_KEY |
im Katalog |
MiniMax hat Coding Plan in Token Plan umbenannt. Die Anbieterkennungen bleiben minimax-coding-plan /
minimax-cn-coding-plan, passend zu models.dev und OpenCode. Verwenden Sie einen Schlüssel des Token Plan
(sk-cp-…) von platform.minimax.io
(international) oder platform.minimaxi.com (China).
huggingfaceist der gehostete Router Serverless Inference Providers (https://router.huggingface.co/v1). Er hat nichts mit dem lokalen Snapshot-Cache von Hugging Face zu tun, den AX Engine zum Speichern heruntergeladener lokaler Modelle nutzt —huggingfacezu verbinden startet die lokale Engine nie und verlangt sie nicht.
Für einen ersten kostenlosen Lauf siehe Schnelleinstieg für kostenlose APIs. Er unterscheidet das kostenlose Angebot eines Anbieters von der Kompatibilität von AX Code und erklärt, warum ein externer Katalog kostenloser APIs selbst keine Unterstützungsmatrix ist.
Grok wird nur über den unten aufgeführten Anbieter grok-build-cli unterstützt. AX Code enthält keinen direkten Cloud-API-Anbieter xai mehr; bestehende Grok-API-Zugangsdaten erzeugen keine Verbindung.
github-copilot ist die Kontenbrücke von GitHub Copilot. Sie ist nicht die getrennte API github-models, die manche
Verzeichnisse kostenloser APIs aufführen.
Mit OpenAI und Anthropic kompatible Gateways werden auch über die Konfiguration eines eigenen Anbieters unterstützt. Siehe Eigene Anbieter und Gateways.
Private GPU-Cloud
Diese Anbieter erscheinen in /connect unter Private GPU-Cloud, nach der lokalen LLM-Laufzeit.
Wählen Sie Eigener Anbieter, um Ihren eigenen mit OpenAI kompatiblen GPU-Endpunkt zu verbinden.
Geben Sie dessen URL und API-Schlüssel ein; AX Code ermittelt Modelle über /v1/models und speichert
den Schlüssel im verschlüsselten Speicher für die Authentifizierung. Die gespeicherte Verbindung bleibt in der privaten GPU-
Cloud. Wählen Sie sie erneut, um ein Modell zu wählen, den Endpunkt zu ersetzen oder zu trennen.
Dieser Eintrag speichert einen konfigurierbaren Endpunkt unter custom-private-gpu.
Katalog (API-Schlüssel)
Gehostete GPU-Kataloge im Stil von OpenCode. Modelle kommen aus dem gebündelten Snapshot von models.dev. Verbinden Sie sich mit einem API-Schlüssel.
| Anbieterkennung | Anzeigename | Umgebungsvariablen für Zugangsdaten | Hinweis |
|---|---|---|---|
nebius |
Nebius Token Factory | NEBIUS_API_KEY |
im Katalog |
fireworks-ai |
Fireworks AI | FIREWORKS_API_KEY |
im Katalog |
togetherai |
Together AI | TOGETHER_API_KEY |
im Katalog |
baseten |
Baseten | BASETEN_API_KEY |
im Katalog |
nvidia |
NVIDIA NIM | NVIDIA_API_KEY |
im Katalog |
deepinfra |
Deep Infra | DEEPINFRA_API_KEY |
im Katalog |
Der gehostete Router von Hugging Face (huggingface / HF_TOKEN) bleibt bei den Cloud-API-Anbietern. Dedizierte Hugging Face Inference Endpoints stehen unten.
Dediziert (URL und Token)
Dedizierte GPU-Endpunkte im Stil von PAI. Fügen Sie die mit OpenAI kompatible URL und das Token ein; AX Code ruft GET …/models auf und verwendet die Kennungen der bereitgestellten Modelle. Das sind nicht die Anbieter Alibaba Coding Plan / Token Plan (DashScope).
| Anbieterkennung | Anzeigename | Umgebungsvariablen für Zugangsdaten | Hinweis |
|---|---|---|---|
alibaba-pai |
Alibaba PAI-EAS | ALIBABA_PAI_API_KEY, ALIBABA_PAI_BASE_URL |
im Katalog |
runpod |
RunPod | RUNPOD_API_KEY, RUNPOD_BASE_URL |
im Katalog |
huggingface-endpoints |
Hugging Face Endpoints | HF_ENDPOINTS_TOKEN, HF_ENDPOINTS_BASE_URL |
im Katalog |
sagemaker |
Amazon SageMaker | SAGEMAKER_API_KEY, SAGEMAKER_BASE_URL |
im Katalog |
volcengine-ark |
Volcengine Ark | ARK_API_KEY, ARK_BASE_URL |
im Katalog |
modelarts |
Huawei ModelArts | MODELARTS_API_KEY, MODELARTS_BASE_URL |
im Katalog |
tencent-ti |
Tencent TI | TENCENT_TI_API_KEY, TENCENT_TI_BASE_URL |
im Katalog |
custom-private-gpu |
Eigener Anbieter | CUSTOM_PRIVATE_GPU_API_KEY, CUSTOM_PRIVATE_GPU_BASE_URL |
im Katalog |
sagemaker ist für eine mit OpenAI kompatible URL vor SageMaker (vLLM / TGI / API Gateway). Es signiert nicht mit AWS SigV4.
AX Trust
AX Trust ist die letzte Kategorie in /connect, nach der privaten GPU-Cloud. Wählen Sie
AX Trust verbinden, geben Sie die Basis-URL des Gateways einschließlich /v1 ein und hinterlegen Sie
den API-Schlüssel des Clients. AX Code ermittelt die Modelle des Gateways und speichert den Schlüssel
im verschlüsselten Speicher für die Authentifizierung. Gespeicherte Verbindungen bieten Modellauswahl, Aktualisierung
des Endpunkts, Aktualisierung der Modelle und Löschen.
Eine bestehende URL erneut zu verbinden bewahrt deren Anbieterkennung, Modelle und gespeicherten Schlüssel,
wenn das Token leer gelassen wird. Der Anbieter bleibt in AX Trust, auch mit einem
eigenen Namen. Ältere Kennungen ax-trust und ax-trust-* erscheinen ebenfalls in dieser Kategorie.
AX Trust bleibt Eigentümer der Gateway-Richtlinie, der Genehmigungen und des Audits.
AX Code sendet auf diesen Verbindungen standardmäßig einen Header für die Sitzungsaffinität.
CLI-Anbieter
CLI-Anbieter verwenden eine lokale Hersteller-CLI und deren Anmeldung bzw. Sitzung wieder, statt einen gehosteten API-Schlüssel in AX Code zu speichern.
| Anbieterkennung | Anzeigename | Erforderlicher lokaler Befehl | Unterstützte Modellkennung | Hinweis |
|---|---|---|---|---|
claude-code |
Anthropic (Claude Code) | claude |
claude-code |
lokale CLI |
codex-cli |
OpenAI (Codex CLI) | codex |
codex-cli |
lokale CLI |
grok-build-cli |
Grok Build CLI | grok |
grok-build-cli |
lokale CLI |
muse-cli |
Muse Code CLI | muse |
muse-cli |
lokale CLI |
Führen Sie bei Bedarf zuerst die Anmeldung der Hersteller-CLI aus und danach ax-code providers login <provider-id>. AX Code prüft den CLI-Befehl und speichert nach erfolgreicher Prüfung eine lokale Markierungs-Zugangsangabe.
Für Muse Code installieren Sie die lokale Binärdatei muse, führen muse login aus (oder setzen META_API_KEY) und danach ax-code providers login muse-cli. AX Code verwendet die Sitzung der Muse-CLI (~/.config/muse) wieder, statt einen gehosteten Meta-API-Schlüssel zu speichern. Der gehostete API-Anbieter meta bleibt eine getrennte Verbindung.
Der gehostete MiniMax Token Plan bleibt als minimax-coding-plan / minimax-cn-coding-plan verfügbar. Es gibt keinen gebündelten Anbieter MiniMax Code CLI oder Kimi Code CLI.
Lokaler Anbieter AX Engine
ax-engine ist der eingebaute Anbieter für lokale Inferenz. Er ist nur auf geeigneten Macs mit Apple Silicon verfügbar und bietet nur die Entwicklungspakete AutomatosX Tiel Coder und Cyber-Tiel Coder 35B A3B MXFP4 MTP. Native Fähigkeiten werden geprüft, wenn das Modell startet.
| Anbieterkennung | Modellkennung | Auswahl | Kontext | Ausgabe |
|---|---|---|---|---|
ax-engine |
tiel-coder-35b-axq-mxfp4 |
Tiel Coder 35B A3B MXFP4 MTP (Voreinstellung) | 65,536 | 8,192 |
ax-engine |
cyber-tiel-coder-35b-axq-mxfp4 |
Cyber-Tiel Coder 35B A3B MXFP4 MTP | 65,536 | 8,192 |
Qwen3.8 27B, Ornith, Qwen3-Coder-Next und alle anderen Repositorys sind von der verwalteten Auswahl ausgeschlossen. Historische Aufzeichnungen bleiben für Status und Bereinigung lesbar.
Das voreingestellte lokale Modell ist tiel-coder-35b-axq-mxfp4. Siehe Modellauswahl für AX Engine zu den genau ausgewählten Repositorys sowie zu Hinweisen für Speicher und Datenträger.
Für die bestehende, getrennt konfigurierte Loopback-Schnittstelle zum Anhängen ist /v1/models maßgeblich: AX Code ermittelt die live Modellkennungen, Grenzen für Kontext und Ausgabe, Modalitäten und die Unterstützung strukturierter Werkzeugaufrufe. Ein Modell, das keine strukturierten Werkzeugaufrufe ankündigt, wird für Anfragen eines Coding-Agenten nicht verwendet.
AX Engine verwendet standardmäßig das kompakte Werkzeugprofil core (bash, Ermittlung, Lesen, Bearbeiten und Schreiben von Dateien sowie Skills). Setzen Sie provider.ax-engine.options.toolProfile nur für eine eigene Bereitstellung mit genug Kontext für das vollständige Werkzeugregister auf full.
Die Engine installieren
Lokale Inferenz braucht AX Engine 7.5.7 oder neuer. Installationsprogramme für Macs mit Apple Silicon enthalten bereits einen eigenständigen Sidecar von AX Engine (engine/<version>/ neben der CLI-Laufzeit), daher braucht ein frischer Mac Homebrew nicht.
AX Code löst die Binärdatei danach in dieser Reihenfolge auf:
provider.ax-engine.options.binaryPathinax-code.json(verlangt eine geprüfte Version von mindestens 7.5.7)- die Umgebungsvariable
AX_ENGINE_BIN(verlangt eine geprüfte Version von mindestens 7.5.7) ax-enginein IhremPATH(verlangt eine geprüfte Version von mindestens 7.5.7)- eine von AX Code verwaltete Überlagerungsinstallation (
ax-code providers ax-engine install; verlangt ebenfalls mindestens 7.5.7) - den Sidecar, der in der aktuellen Mac-Laufzeit gebündelt ist
Zuerst wird --version geprüft, danach der Rückfall auf install.version aus ax-engine doctor --json. Der Exit-Code von Doctor meldet die Bereitschaft des Hosts (Metal-Werkzeugkette, MLX-Dateien), daher zählt ein von null verschiedener Exit weiterhin, wenn dieses JSON eine Version enthält. AX Code besitzt den Serverstart und startet normalerweise ax-engine serve auf 127.0.0.1:31418. Die optionale Homebrew-Formula bleibt eine Alternative für Benutzer, die eine von brew verwaltete Engine möchten; sie ist nicht erforderlich.
Verwaltete Tiel-Starts verwenden das Katalogfenster (65,536 Kontext-Tokens und 8,192 Ausgabe-Tokens). Es ist größer als die eingebaute Voreinstellung von 16,384 Tokens von ax-engine serve, damit der Prompt des Agenten passt. Verkleinern Sie eines der Budgets mit provider.ax-engine.options.contextTokens und provider.ax-engine.options.maxOutputTokens (outputTokens ist derselbe Regler für die Ausgabe). Die Namen der Umgebungsvariablen sind AX_ENGINE_CONTEXT_TOKENS und AX_ENGINE_MAX_OUTPUT_TOKENS (AX_ENGINE_OUTPUT_TOKENS ist ein Alias). Eine Überschreibung kann die Katalogobergrenze nur verengen: Ein größerer oder ungültiger Wert wird gemeldet und ignoriert, und ein Fenster von Tiel oder Qwen3.8, das kein Vielfaches von 1,024 ist, wird nach unten gesetzt, damit die Blöcke des Präfix-Cache bei 1,024 Tokens bleiben. Dieselben Zahlen verwenden der laufende Server und die Modellgrenze. Eine live vorliegende Karte /v1/models kann dieses Fenster weiter verkleinern, aber nicht vergrößern. Konfigurierte Optionen haben Vorrang, und AX Code warnt, wenn ein Umgebungswert ignoriert wird. Dieselbe Warnung erscheint, wenn binaryPath AX_ENGINE_BIN ignoriert oder wenn connectionMode / baseURL AX_ENGINE_HOST ignoriert. Ein kleineres Fenster kann für den vollständigen Prompt des Agenten zu klein sein; AX Code lehnt das Modell dann ab, statt einen Prompt zu senden, den der Server nicht halten kann.
Tiel und Cyber-Tiel kündigen strukturierte Werkzeugaufrufe an. Eine live vorliegende Karte /v1/models überschreibt diese Ankündigung weiterhin, sobald der Server läuft. mtpPolicy: disabled schaltet MTP aus, auch wenn die Version der Binärdatei nicht gelesen werden kann; auto und required brauchen weiterhin AX Engine 7.4.0 oder neuer.
Eine Installation über PATH oder Überlagerung, der libmlx.dylib / mlx.metallib fehlt, wird abgelehnt. Die gebündelten Archive und die Überlagerungsarchive sind die eigenständige macOS-Nutzlast 7.5.7.
Die Engine zu installieren lädt kein Modell herunter. Wählen und laden Sie ein Modell danach auf der Desktop-Seite Modelle oder mit ax-code providers ax-engine prepare herunter. Ein vollständiger kompatibler Basis-Snapshot, der bereits im Cache von Hugging Face liegt, wird für direktes Decode angenommen; prepare --download verwendet das bevorzugte MTP-Paket des Katalogs, wenn es verfügbar ist.
Verwenden Sie /connect -> AX-Engine-Laufzeit -> Ein Modell auswählen. AX Code konfiguriert
die lokale Laufzeit und startet sie automatisch, wenn das gewählte Modell gebraucht wird;
URL oder API-Schlüssel sind nicht erforderlich. Status anzeigen, Lokale Laufzeit stoppen und
Deaktivieren verwalten die lokale Laufzeit. Ein Modell zu wählen ersetzt außerdem ältere
Einstellungen für manuelles Anhängen durch die verwaltete lokale Einrichtung.
Die Engine wird nur für macOS mit Apple Silicon ausgeliefert. Auf anderen Hosts verwenden Sie einen gehosteten Anbieter oder ein mit OpenAI kompatibles Anbieter-Gateway; Server von AX Code sind nur lokal.