AX Code holen · KostenlosDokumentation

Diese Seite ist eine Übersetzung der englischen Dokumentation. Befehle, Bezeichner und Beispiele bleiben unverändert. Runtime 7.24.4 · SDK 2.6.7. Englische Fassung

Integration der lokalen Engine (AX Code)

Status: Aktiv Geltungsbereich: aktueller Stand Zuletzt geprüft: 2026-09-19 Verantwortlich: ax-code runtime Verwandt: ax-engine LOCAL-ENGINE-CLIENTS

Einrichtung der lokalen Laufzeit

Wählen Sie in /connect AX-Engine-Laufzeit und danach Ein Modell auswählen. AX Code konfiguriert die lokale Laufzeit und startet sie, wenn das gewählte Modell gebraucht wird. Es gibt kein Formular für eine Endpunkt-URL oder einen API-Schlüssel. Status anzeigen, Lokale Laufzeit stoppen (wenn sie läuft) und Deaktivieren verwalten den lokalen Prozess.

AX Code verwendet für AX Engine das Backend Sidecar-HTTP. Es startet ax-engine serve, verfolgt den eigenen Prozess und löst Loopback-Adresse und Port automatisch auf. Sie wählen ein Modell; AX Code übernimmt die Konfiguration des Transports.

AX Code (TypeScript)
  -> select local model -> ensure/prepare -> spawn ax-engine serve
  -> managed loopback /v1 -> @ai-sdk/openai-compatible language model

Ein Modell ausdrücklich zu wählen speichert den verwalteten Lebenszyklus und löscht ältere Einstellungen für angehängten Endpunkt und Schlüssel. Das überschreibt auch einen noch gesetzten Wert AX_ENGINE_HOST. Ältere SDK-Clients behalten die alte API zum Anhängen nur über Loopback und die zugehörige Prüfung der Zugangsdaten. Dieser Kompatibilitätsweg gehört nicht zum Anbietermenü.

AX Code bindet das SDK von AX Engine nicht im Prozess ein. AX Engine besitzt die Modellausführung, und AX Code besitzt den Prozesslebenszyklus auf der Clientseite. Die Eignung des Hosts, die Vorbereitung des Modells und die Live-Prüfungen von Werkzeugaufrufen gelten weiterhin.

Der Kaltstart hat eine Bereitschaftsgrenze von 600 Sekunden. Die Startzeit hängt von der Größe des Modells, vom Speicherdurchsatz und vom verfügbaren Speicher ab. Ist diese Grenze erschöpft, endet der Zug mit dem Serverprotokoll und dem Modellpfad; AX Code startet nicht automatisch einen weiteren Kaltstart und wechselt nicht den Anbieter. Beheben Sie das gemeldete Problem, bevor Sie ausdrücklich erneut versuchen. Der Rahmen der Modelleinrichtung, einschließlich des Wartens auf die Lebenszyklussperre und der Ermittlung der Fähigkeiten, ist auf 660 Sekunden begrenzt. Der Ablauf bricht eine ausstehende Einrichtung ab und stoppt automatische Wiederholungen. Das Abbrechen einer Anfrage beendet das Warten ebenfalls sofort, auch wenn eine Abhängigkeit der Einrichtung noch nicht geantwortet hat. Health-Antworten, die nach der Bereitschaftsfrist oder nach dem Ende des eigenen Prozesses eintreffen, können keine Bereitschaft herstellen.

Sobald die Engine bereit ist, bleibt sie über die Züge des Gesprächs hinweg resident. Das Abschließen oder Abbrechen des auslösenden Zugs stoppt die bereite Engine nicht. Ein Abbruch, während der Start noch läuft, beendet diesen Versuch und entfernt seinen Prozesseintrag. Verwenden Sie Lokale Laufzeit stoppen, um eine residente Engine ausdrücklich zu stoppen.

AX Code folgt dem üblichen Cache-Ort von Hugging Face und respektiert Ihre Speicherwahl, einschließlich lokaler Datenträger sowie Einbindungen über SMB und NFS. Die Auflösung des Cache ist HF_HUB_CACHE, dann HF_HOME/hub, dann XDG_CACHE_HOME/huggingface/hub, dann ~/.cache/huggingface/hub. Ein ausdrücklich konfigurierter oder bereits vorbereiteter Modellpfad hat Vorrang vor der Ermittlung im Cache. AX Code verschiebt Gewichte nicht und überschreibt diese Wahl nicht aufgrund des Speichertyps. Die Startdiagnose meldet den tatsächlichen Modellpfad, damit Sie Verfügbarkeit und Leseleistung in Ihrem gewählten Speicher untersuchen können.

Bei einer bestehenden Engine führt AX Code bis zu drei Health-Prüfungen aus, jeweils auf zwei Sekunden begrenzt und durch 250 Millisekunden getrennt, bevor ein nicht antwortender Prozess neu gestartet wird. Das Abbrechen der Anfrage erhält den bestehenden Prozess.

Warum Sidecar

Faktor Wahl des Sidecars
Hostsprache Agentenlaufzeit auf Node/Bun mit einer ausdrücklichen Grenze zum nativen Prozess
Isolation Modelle mit mehreren GB und native Abstürze bleiben außerhalb des Agentenprozesses
Aktualisierung Versionsgebundene gebündelte Untergrenze plus optionale verwaltete Überlagerung, ohne ax-code neu zu bauen
Anbietermodell Derselbe mit OpenAI kompatible Weg wie bei anderen lokalen oder Cloud-Anbietern
Mehrere Clients Ein Server lässt sich über server.json auf Gesundheit prüfen und stoppen

Lebenszyklusphasen

Implementierung: packages/ax-code/src/provider/ax-engine/lifecycle.ts

Phase Wann (Zuordnung in AX Code)
unavailable Die Eignung der Plattform scheitert
missing_dependency Binärdatei fehlt / Version zu alt / nicht ausführbar
missing_model Modellpfad nicht vorbereitet
starting Serverprozess aufgezeichnet, aber noch nicht bereit
ready server.ready und die Gesundheit des Prozesses sind in Ordnung
degraded Bereit, aber die Prüfung der Fähigkeiten meldet, dass Werkzeugaufrufe nicht unterstützt werden
error Blocker durch Fehler bei Health oder Start in einem laufenden Versuch

Die Reihenfolge der Schwere entspricht docs/LOCAL-ENGINE-CLIENTS.md von ax-engine.

Bereich Pfad
Start und Gesundheit des Servers packages/ax-code/src/provider/ax-engine/server.ts
Anbieterlader (verwaltet und anhängen) packages/ax-code/src/provider/ax-engine/provider-loader.ts
Lokale Laufzeit der TUI packages/ax-code/src/cli/tui/component/dialog-provider.tsx
Helfer für lokale Aktionen packages/ax-code/src/cli/tui/component/dialog-provider-options.ts
Zusammengefasster Status packages/ax-code/src/provider/ax-engine/status.ts
Zuordnung der Phasen packages/ax-code/src/provider/ax-engine/lifecycle.ts
Modellrichtlinie Modellauswahl für AX Engine

Die verwaltete Bereitstellung eines festgelegten Sidecars ist keine Einbettung im Prozess. Veröffentlichungen für Darwin-arm64 legen engine/<version>/ neben die CLI; ax-code providers ax-engine install ist die Überlagerung bzw. die Aktualisierung, wenn eine neuere Festlegung veröffentlicht wird.

Nicht-Ziele

  • Den Sidecar in AX Code durch eine Einbettung des SDK im Prozess zu ersetzen
  • gRPC als primären Transport für den Chat zu übernehmen
  • Einen eigenen Unix-Socket oder ein Framing für den Chat, das nicht OpenAI entspricht, für Clients aus erster Hand
  • Modellgewichte in das Installationsprogramm von AX Code einzubauen