AX Code holen · KostenlosDokumentation

Diese Seite ist eine Übersetzung der englischen Dokumentation. Befehle, Bezeichner und Beispiele bleiben unverändert. Runtime 7.24.4 · SDK 2.6.7. Englische Fassung

Unterstützte Anbieter und Modelle

Status: Aktiv Geltungsbereich: aktueller Stand Zuletzt geprüft: 2026-09-19 Verantwortlich: ax-code runtime

Diese Seite listet die Anbietervoreinstellungen, die AX Code in den voreingestellten Einrichtungsabläufen anbietet. Maßgeblich sind die Zulassungsliste der Laufzeitanbieter in packages/ax-code/src/provider/default-setup-providers.ts, der gebündelte Modell-Snapshot in packages/ax-code/src/provider/models-snapshot.json, die Voreinstellungen der lokalen Laufzeit in packages/ax-code/src/provider/local-runtime.ts und die Definitionen von AX Engine in packages/ax-code/src/provider/ax-engine/constants.ts.

Verwenden Sie /connect in der Terminaloberfläche oder ax-code providers login <provider-id> für die interaktive Einrichtung. Kopflose Umgebungen und CI können außerdem die aufgeführten Umgebungsvariablen setzen.

Verbundene Anbieter verwalten

Die Sitzungsansicht hält eine obere Leiste mit der Sitzungskennung (Klick kopiert), dem Titel und dem Live-Status, danach einen Eintrag Anbieter mit der Zahl der Verbindungen; klicken Sie darauf oder auf verwalten, um die Anbieterverwaltung zu öffnen, die auch als Befehl /providers verfügbar ist. Von dort wählen Sie ein Modell, deaktivieren oder trennen jeden Anbieter oder springen zum vollständigen Ablauf /connect.

  • Einen Schlüssel ersetzen: Wählen Sie den Anbieter in /connect und Schlüssel ersetzen, oder führen Sie ax-code providers login <provider-id> erneut aus.
  • Vorübergehend deaktivieren: Wählen Sie Deaktivieren in /providers oder /connect oder führen Sie ax-code providers disable <provider-id> aus. Das fügt den Anbieter zu disabled_providers in der globalen Konfiguration hinzu und behält die gespeicherten Zugangsdaten. Deaktivierte Anbieter bleiben in /providers und unter Deaktiviert in /connect sichtbar und lassen sich mit Aktivieren oder ax-code providers enable <provider-id> wieder einschalten.
  • Dauerhaft trennen: Wählen Sie Trennen in /providers oder /connect oder führen Sie ax-code providers logout <provider-id> aus — das löscht die gespeicherte Zugangsangabe aus auth.json.

Kataloge gehosteter Modelle sind mit jeder Veröffentlichung von AX Code gebündelt und auf nutzbare Fähigkeiten eines Coding-Agenten gefiltert. Führen Sie ax-code models <provider-id> aus, um die maßgeblichen Modellkennungen Ihrer installierten Version zu sehen; das rohe Register und kopierte Weblisten können Modelle enthalten, die AX Code verbirgt, weil ihnen Textausgabe oder Werkzeugaufrufe fehlen. Eine Anbietervoreinstellung bedeutet nicht, dass jedes Modell kostenlos oder auf jedem Konto verfügbar ist.

Laufzeitwahl

Ein Modell ohne Version wählen

Sowohl die TUI als auch ax-code run akzeptieren diese Familiennamen --model ohne Berücksichtigung der Großschreibung:

Familie Modell
deepseek deepseek-flash
glm glm-5.3-flash
qwen qwen3.8-flash

Zum Beispiel öffnet ax-code --model glm die TUI mit GLM Flash, und ax-code run --model qwen -- "Review this change" fordert Qwen Flash an. Setzen Sie den Prompt nach -- (oder übergeben Sie --prompt / --prompt-file); --file hängt Dateien an und ist keine Prompt-Datei. ax-code models listet nutzbare Kennungen provider/model. Familiennamen werden über den nativen Anbieter oder ein verbundenes Gateway aufgelöst, das dasselbe Modell bereitstellt. Sie können den Anbieter auch nennen: --model my-gateway/glm. Verwenden Sie eine vollständige Kennung wie my-gateway/glm-5.3, um eine bestimmte Version oder Stufe anzufordern.

--model wegzulassen bewahrt konfigurierte, Agenten-, Sitzungs- und jüngere Modellwahlen. Wenn keine nutzbare Wahl vorliegt, beginnt die gemeinsame Rückfallreihenfolge mit DeepSeek Flash, dann GLM Flash, dann Qwen Flash über verbundene Anbieter. Die Anbietereinrichtung hat eigene Voreinstellungen: Alibaba Coding Plan verwendet qwen3-coder-plus; Alibaba Token Plan verwendet qwen3.8-flash.

Eine Laufzeit verbinden

Die Auswahl in /connect ist geordnet: Cloud-API-Anbieter, CLI-Anbieter, AX-Engine-Laufzeit, Lokale LLM-Laufzeit, Private GPU-Cloud und AX Trust. Die AX-Engine-Laufzeit öffnet die Auswahl lokaler Modelle und die Laufzeitverwaltung direkt. Die lokale LLM-Laufzeit listet diese Auswahl in dieser Reihenfolge:

Menüoption Anbieterkennung Voreingestellter Endpunkt Umgebungsvariable des Hosts
Ollama ollama http://localhost:11434/v1 OLLAMA_HOST
LMStudio lmstudio http://localhost:1234/v1 LMSTUDIO_HOST
MTPLX mtplx http://localhost:8000/v1 MTPLX_HOST
oMLX omlx http://localhost:8000/v1 OMLX_HOST
AX-Studio ax-studio http://localhost:18080/v1 AX_STUDIO_HOST
Weitere local-llm Geben Sie Ihren mit OpenAI kompatiblen Endpunkt ein LOCAL_LLM_HOST

Die Voreinstellungen für MTPLX und oMLX sind im Quell-Checkout verfügbar; gepackte Binärdateien von v7.19.3 enthalten sie nicht. Siehe Einrichtung von MTPLX und oMLX zur Konfiguration der Werkzeugfähigkeit, zur optionalen Authentifizierung und zum gemeinsamen Vorbehalt des voreingestellten Ports.

Starten Sie Ihren lokalen Server, wählen Sie seinen Menüeintrag und bestätigen oder bearbeiten Sie den Endpunkt. AX Code ergänzt /v1, wenn es fehlt. Weitere speichert einen konfigurierbaren Endpunkt unter local-llm; wählen Sie ihn erneut, um den Endpunkt zu ändern. LMStudio und Weitere verwenden den bestehenden lokalen Einrichtungsablauf ohne Abfrage eines API-Tokens. LM Studio dokumentiert seinen Endpunkt für die Modellliste.

Einrichtungsentscheidungen respektieren enabled_providers und disabled_providers. Die Auswahl nur zu öffnen aktiviert oder prüft diese lokalen Server nicht. Ermittelte externe lokale Modelle behalten konservative Fähigkeitsvoreinstellungen; Modelle müssen Werkzeugaufrufe unterstützen, um für Abläufe eines Coding-Agenten wählbar zu sein.

Cloud-API-Anbieter

Diese Anbieter rufen gehostete APIs oder gehostete Endpunkte von Kontenplänen auf.

Anbieterkennung Anzeigename Umgebungsvariablen für Zugangsdaten Hinweis
google Google GOOGLE_API_KEY, GOOGLE_GENERATIVE_AI_API_KEY, GEMINI_API_KEY im Katalog
deepseek DeepSeek DEEPSEEK_API_KEY im Katalog
meta Meta (Muse Spark) MODEL_API_KEY, META_MODEL_API_KEY im Katalog
groq GroqCloud GROQ_API_KEY im Katalog
openrouter OpenRouter OPENROUTER_API_KEY im Katalog
huggingface Hugging Face HF_TOKEN im Katalog
unorouter UnoRouter UNOROUTER_API_KEY im Katalog
alibaba-coding-plan Alibaba Coding Plan ALIBABA_CODING_PLAN_INTL_API_KEY, ALIBABA_CODING_PLAN_API_KEY im Katalog
alibaba-coding-plan-cn Alibaba Coding Plan (China) ALIBABA_CODING_PLAN_CN_API_KEY, ALIBABA_CODING_PLAN_API_KEY im Katalog
alibaba-token-plan Alibaba Token Plan ALIBABA_TOKEN_PLAN_INTL_API_KEY, ALIBABA_TOKEN_PLAN_API_KEY im Katalog
alibaba-token-plan-cn Alibaba Token Plan (China) ALIBABA_TOKEN_PLAN_CN_API_KEY, ALIBABA_TOKEN_PLAN_API_KEY im Katalog
github-copilot GitHub Copilot GITHUB_TOKEN im Katalog
zai Z.AI ZHIPU_API_KEY im Katalog
zai-coding-plan Z.AI Coding Plan ZHIPU_API_KEY im Katalog
minimax-coding-plan MiniMax Token Plan MINIMAX_TOKEN_PLAN_API_KEY, MINIMAX_API_KEY im Katalog
minimax-cn-coding-plan MiniMax Token Plan (China) MINIMAX_TOKEN_PLAN_CN_API_KEY, MINIMAX_API_KEY im Katalog

MiniMax hat Coding Plan in Token Plan umbenannt. Die Anbieterkennungen bleiben minimax-coding-plan / minimax-cn-coding-plan, passend zu models.dev und OpenCode. Verwenden Sie einen Schlüssel des Token Plan (sk-cp-…) von platform.minimax.io (international) oder platform.minimaxi.com (China).

huggingface ist der gehostete Router Serverless Inference Providers (https://router.huggingface.co/v1). Er hat nichts mit dem lokalen Snapshot-Cache von Hugging Face zu tun, den AX Engine zum Speichern heruntergeladener lokaler Modelle nutzt — huggingface zu verbinden startet die lokale Engine nie und verlangt sie nicht.

Für einen ersten kostenlosen Lauf siehe Schnelleinstieg für kostenlose APIs. Er unterscheidet das kostenlose Angebot eines Anbieters von der Kompatibilität von AX Code und erklärt, warum ein externer Katalog kostenloser APIs selbst keine Unterstützungsmatrix ist.

Grok wird nur über den unten aufgeführten Anbieter grok-build-cli unterstützt. AX Code enthält keinen direkten Cloud-API-Anbieter xai mehr; bestehende Grok-API-Zugangsdaten erzeugen keine Verbindung.

github-copilot ist die Kontenbrücke von GitHub Copilot. Sie ist nicht die getrennte API github-models, die manche Verzeichnisse kostenloser APIs aufführen.

Mit OpenAI und Anthropic kompatible Gateways werden auch über die Konfiguration eines eigenen Anbieters unterstützt. Siehe Eigene Anbieter und Gateways.

Private GPU-Cloud

Diese Anbieter erscheinen in /connect unter Private GPU-Cloud, nach der lokalen LLM-Laufzeit.

Wählen Sie Eigener Anbieter, um Ihren eigenen mit OpenAI kompatiblen GPU-Endpunkt zu verbinden. Geben Sie dessen URL und API-Schlüssel ein; AX Code ermittelt Modelle über /v1/models und speichert den Schlüssel im verschlüsselten Speicher für die Authentifizierung. Die gespeicherte Verbindung bleibt in der privaten GPU- Cloud. Wählen Sie sie erneut, um ein Modell zu wählen, den Endpunkt zu ersetzen oder zu trennen. Dieser Eintrag speichert einen konfigurierbaren Endpunkt unter custom-private-gpu.

Katalog (API-Schlüssel)

Gehostete GPU-Kataloge im Stil von OpenCode. Modelle kommen aus dem gebündelten Snapshot von models.dev. Verbinden Sie sich mit einem API-Schlüssel.

Anbieterkennung Anzeigename Umgebungsvariablen für Zugangsdaten Hinweis
nebius Nebius Token Factory NEBIUS_API_KEY im Katalog
fireworks-ai Fireworks AI FIREWORKS_API_KEY im Katalog
togetherai Together AI TOGETHER_API_KEY im Katalog
baseten Baseten BASETEN_API_KEY im Katalog
nvidia NVIDIA NIM NVIDIA_API_KEY im Katalog
deepinfra Deep Infra DEEPINFRA_API_KEY im Katalog

Der gehostete Router von Hugging Face (huggingface / HF_TOKEN) bleibt bei den Cloud-API-Anbietern. Dedizierte Hugging Face Inference Endpoints stehen unten.

Dediziert (URL und Token)

Dedizierte GPU-Endpunkte im Stil von PAI. Fügen Sie die mit OpenAI kompatible URL und das Token ein; AX Code ruft GET …/models auf und verwendet die Kennungen der bereitgestellten Modelle. Das sind nicht die Anbieter Alibaba Coding Plan / Token Plan (DashScope).

Anbieterkennung Anzeigename Umgebungsvariablen für Zugangsdaten Hinweis
alibaba-pai Alibaba PAI-EAS ALIBABA_PAI_API_KEY, ALIBABA_PAI_BASE_URL im Katalog
runpod RunPod RUNPOD_API_KEY, RUNPOD_BASE_URL im Katalog
huggingface-endpoints Hugging Face Endpoints HF_ENDPOINTS_TOKEN, HF_ENDPOINTS_BASE_URL im Katalog
sagemaker Amazon SageMaker SAGEMAKER_API_KEY, SAGEMAKER_BASE_URL im Katalog
volcengine-ark Volcengine Ark ARK_API_KEY, ARK_BASE_URL im Katalog
modelarts Huawei ModelArts MODELARTS_API_KEY, MODELARTS_BASE_URL im Katalog
tencent-ti Tencent TI TENCENT_TI_API_KEY, TENCENT_TI_BASE_URL im Katalog
custom-private-gpu Eigener Anbieter CUSTOM_PRIVATE_GPU_API_KEY, CUSTOM_PRIVATE_GPU_BASE_URL im Katalog

sagemaker ist für eine mit OpenAI kompatible URL vor SageMaker (vLLM / TGI / API Gateway). Es signiert nicht mit AWS SigV4.

AX Trust

AX Trust ist die letzte Kategorie in /connect, nach der privaten GPU-Cloud. Wählen Sie AX Trust verbinden, geben Sie die Basis-URL des Gateways einschließlich /v1 ein und hinterlegen Sie den API-Schlüssel des Clients. AX Code ermittelt die Modelle des Gateways und speichert den Schlüssel im verschlüsselten Speicher für die Authentifizierung. Gespeicherte Verbindungen bieten Modellauswahl, Aktualisierung des Endpunkts, Aktualisierung der Modelle und Löschen.

Eine bestehende URL erneut zu verbinden bewahrt deren Anbieterkennung, Modelle und gespeicherten Schlüssel, wenn das Token leer gelassen wird. Der Anbieter bleibt in AX Trust, auch mit einem eigenen Namen. Ältere Kennungen ax-trust und ax-trust-* erscheinen ebenfalls in dieser Kategorie. AX Trust bleibt Eigentümer der Gateway-Richtlinie, der Genehmigungen und des Audits. AX Code sendet auf diesen Verbindungen standardmäßig einen Header für die Sitzungsaffinität.

CLI-Anbieter

CLI-Anbieter verwenden eine lokale Hersteller-CLI und deren Anmeldung bzw. Sitzung wieder, statt einen gehosteten API-Schlüssel in AX Code zu speichern.

Anbieterkennung Anzeigename Erforderlicher lokaler Befehl Unterstützte Modellkennung Hinweis
claude-code Anthropic (Claude Code) claude claude-code lokale CLI
codex-cli OpenAI (Codex CLI) codex codex-cli lokale CLI
grok-build-cli Grok Build CLI grok grok-build-cli lokale CLI
muse-cli Muse Code CLI muse muse-cli lokale CLI

Führen Sie bei Bedarf zuerst die Anmeldung der Hersteller-CLI aus und danach ax-code providers login <provider-id>. AX Code prüft den CLI-Befehl und speichert nach erfolgreicher Prüfung eine lokale Markierungs-Zugangsangabe.

Für Muse Code installieren Sie die lokale Binärdatei muse, führen muse login aus (oder setzen META_API_KEY) und danach ax-code providers login muse-cli. AX Code verwendet die Sitzung der Muse-CLI (~/.config/muse) wieder, statt einen gehosteten Meta-API-Schlüssel zu speichern. Der gehostete API-Anbieter meta bleibt eine getrennte Verbindung.

Der gehostete MiniMax Token Plan bleibt als minimax-coding-plan / minimax-cn-coding-plan verfügbar. Es gibt keinen gebündelten Anbieter MiniMax Code CLI oder Kimi Code CLI.

Lokaler Anbieter AX Engine

ax-engine ist der eingebaute Anbieter für lokale Inferenz. Er ist nur auf geeigneten Macs mit Apple Silicon verfügbar und bietet nur die Entwicklungspakete AutomatosX Tiel Coder und Cyber-Tiel Coder 35B A3B MXFP4 MTP. Native Fähigkeiten werden geprüft, wenn das Modell startet.

Anbieterkennung Modellkennung Auswahl Kontext Ausgabe
ax-engine tiel-coder-35b-axq-mxfp4 Tiel Coder 35B A3B MXFP4 MTP (Voreinstellung) 65,536 8,192
ax-engine cyber-tiel-coder-35b-axq-mxfp4 Cyber-Tiel Coder 35B A3B MXFP4 MTP 65,536 8,192

Qwen3.8 27B, Ornith, Qwen3-Coder-Next und alle anderen Repositorys sind von der verwalteten Auswahl ausgeschlossen. Historische Aufzeichnungen bleiben für Status und Bereinigung lesbar.

Das voreingestellte lokale Modell ist tiel-coder-35b-axq-mxfp4. Siehe Modellauswahl für AX Engine zu den genau ausgewählten Repositorys sowie zu Hinweisen für Speicher und Datenträger.

Für die bestehende, getrennt konfigurierte Loopback-Schnittstelle zum Anhängen ist /v1/models maßgeblich: AX Code ermittelt die live Modellkennungen, Grenzen für Kontext und Ausgabe, Modalitäten und die Unterstützung strukturierter Werkzeugaufrufe. Ein Modell, das keine strukturierten Werkzeugaufrufe ankündigt, wird für Anfragen eines Coding-Agenten nicht verwendet.

AX Engine verwendet standardmäßig das kompakte Werkzeugprofil core (bash, Ermittlung, Lesen, Bearbeiten und Schreiben von Dateien sowie Skills). Setzen Sie provider.ax-engine.options.toolProfile nur für eine eigene Bereitstellung mit genug Kontext für das vollständige Werkzeugregister auf full.

Die Engine installieren

Lokale Inferenz braucht AX Engine 7.5.7 oder neuer. Installationsprogramme für Macs mit Apple Silicon enthalten bereits einen eigenständigen Sidecar von AX Engine (engine/<version>/ neben der CLI-Laufzeit), daher braucht ein frischer Mac Homebrew nicht.

AX Code löst die Binärdatei danach in dieser Reihenfolge auf:

  1. provider.ax-engine.options.binaryPath in ax-code.json (verlangt eine geprüfte Version von mindestens 7.5.7)
  2. die Umgebungsvariable AX_ENGINE_BIN (verlangt eine geprüfte Version von mindestens 7.5.7)
  3. ax-engine in Ihrem PATH (verlangt eine geprüfte Version von mindestens 7.5.7)
  4. eine von AX Code verwaltete Überlagerungsinstallation (ax-code providers ax-engine install; verlangt ebenfalls mindestens 7.5.7)
  5. den Sidecar, der in der aktuellen Mac-Laufzeit gebündelt ist

Zuerst wird --version geprüft, danach der Rückfall auf install.version aus ax-engine doctor --json. Der Exit-Code von Doctor meldet die Bereitschaft des Hosts (Metal-Werkzeugkette, MLX-Dateien), daher zählt ein von null verschiedener Exit weiterhin, wenn dieses JSON eine Version enthält. AX Code besitzt den Serverstart und startet normalerweise ax-engine serve auf 127.0.0.1:31418. Die optionale Homebrew-Formula bleibt eine Alternative für Benutzer, die eine von brew verwaltete Engine möchten; sie ist nicht erforderlich.

Verwaltete Tiel-Starts verwenden das Katalogfenster (65,536 Kontext-Tokens und 8,192 Ausgabe-Tokens). Es ist größer als die eingebaute Voreinstellung von 16,384 Tokens von ax-engine serve, damit der Prompt des Agenten passt. Verkleinern Sie eines der Budgets mit provider.ax-engine.options.contextTokens und provider.ax-engine.options.maxOutputTokens (outputTokens ist derselbe Regler für die Ausgabe). Die Namen der Umgebungsvariablen sind AX_ENGINE_CONTEXT_TOKENS und AX_ENGINE_MAX_OUTPUT_TOKENS (AX_ENGINE_OUTPUT_TOKENS ist ein Alias). Eine Überschreibung kann die Katalogobergrenze nur verengen: Ein größerer oder ungültiger Wert wird gemeldet und ignoriert, und ein Fenster von Tiel oder Qwen3.8, das kein Vielfaches von 1,024 ist, wird nach unten gesetzt, damit die Blöcke des Präfix-Cache bei 1,024 Tokens bleiben. Dieselben Zahlen verwenden der laufende Server und die Modellgrenze. Eine live vorliegende Karte /v1/models kann dieses Fenster weiter verkleinern, aber nicht vergrößern. Konfigurierte Optionen haben Vorrang, und AX Code warnt, wenn ein Umgebungswert ignoriert wird. Dieselbe Warnung erscheint, wenn binaryPath AX_ENGINE_BIN ignoriert oder wenn connectionMode / baseURL AX_ENGINE_HOST ignoriert. Ein kleineres Fenster kann für den vollständigen Prompt des Agenten zu klein sein; AX Code lehnt das Modell dann ab, statt einen Prompt zu senden, den der Server nicht halten kann.

Tiel und Cyber-Tiel kündigen strukturierte Werkzeugaufrufe an. Eine live vorliegende Karte /v1/models überschreibt diese Ankündigung weiterhin, sobald der Server läuft. mtpPolicy: disabled schaltet MTP aus, auch wenn die Version der Binärdatei nicht gelesen werden kann; auto und required brauchen weiterhin AX Engine 7.4.0 oder neuer.

Eine Installation über PATH oder Überlagerung, der libmlx.dylib / mlx.metallib fehlt, wird abgelehnt. Die gebündelten Archive und die Überlagerungsarchive sind die eigenständige macOS-Nutzlast 7.5.7.

Die Engine zu installieren lädt kein Modell herunter. Wählen und laden Sie ein Modell danach auf der Desktop-Seite Modelle oder mit ax-code providers ax-engine prepare herunter. Ein vollständiger kompatibler Basis-Snapshot, der bereits im Cache von Hugging Face liegt, wird für direktes Decode angenommen; prepare --download verwendet das bevorzugte MTP-Paket des Katalogs, wenn es verfügbar ist.

Verwenden Sie /connect -> AX-Engine-Laufzeit -> Ein Modell auswählen. AX Code konfiguriert die lokale Laufzeit und startet sie automatisch, wenn das gewählte Modell gebraucht wird; URL oder API-Schlüssel sind nicht erforderlich. Status anzeigen, Lokale Laufzeit stoppen und Deaktivieren verwalten die lokale Laufzeit. Ein Modell zu wählen ersetzt außerdem ältere Einstellungen für manuelles Anhängen durch die verwaltete lokale Einrichtung.

Die Engine wird nur für macOS mit Apple Silicon ausgeliefert. Auf anderen Hosts verwenden Sie einen gehosteten Anbieter oder ein mit OpenAI kompatibles Anbieter-Gateway; Server von AX Code sind nur lokal.