AX Code holen · KostenlosDokumentation

Diese Seite ist eine Übersetzung der englischen Dokumentation. Befehle, Bezeichner und Beispiele bleiben unverändert. Runtime 7.24.5 · SDK 2.6.9. Englische Fassung

Tiel / Cyber-Tiel: AX Engine gegenüber MTPLX (20. September 2026)

Status: Aktiv Umfang: öffentliche Zusammenfassung der nativen API-Kampagne von AX Engine auf vier Rechnern Zuletzt geprüft: 2026-09-21 Verantwortlich: AX-Code-Laufzeit

AX Code ist der Harness des Coding-Agenten. AX Engine ist die Apple-Silicon-Inferenzlaufzeit, die es bündelt (signierter Sidecar 7.5.7, ax-engine serve). Diese Seite zeichnet die aktuellen zugeordneten Tiel-Vergleichszahlen auf, damit die README von AX Code den Schnappschuss vom 19. September auf dem M3 Max nicht weiter so führt, als wäre er noch die Rangfolge.

Kanonische Tabellen, Stichprobenstreuung, TTFT, Speicher und Reproduktion leben in AX Engine:

Behandeln Sie diese Seite nicht als Ersatz für diese Artefakte.

Was gemessen wurde

  • Pakete: AutomatosX/AX-Tiel-Coder-35B-A3B-MLX-AXQ-MXFP4-MTP (AX Code verwalteter Standard) und AutomatosX/AX-Cyber-Tiel-Coder-35B-A3B-MLX-AXQ-MXFP4-MTP (Alternative).
  • Vergleichspartner: MTPLX 2.11.3 anhaltend, dieselben Modelldateien, dieselben Prompt-Token-Arrays.
  • Primäre Metrik: Abschluss-Token/s einschließlich TTFT (Einstieg der nativen API bis zum letzten Rückruf).
  • Decode-Token/s schließen den ersten Rückruf aus. Das ist nicht die primäre Metrik und nicht die Sitzungsgeschwindigkeit von AX Code.
  • Sechs gemessene Stichproben je Zelle, kalter KV, MTP-Tiefe 3, vollständig residente Gewichte.
  • Nicht der Standard ax-engine serve, keine Coding-Sitzung von AX Code, keine Qualitätsaussage.

Leitzeilen (M5 Max 128 GiB)

Paket Arbeitslast Abschluss (AX gegenüber MTPLX) Decode (AX gegenüber MTPLX)
Tiel (Standard) python-lru 194.88 gegenüber 177.44 217.85 gegenüber 198.40
Cyber-Tiel (Alternative) python-lru 219.43 gegenüber 194.15 249.01 gegenüber 219.84

194.88 ist die öffentliche Zahl für das verwaltete Standardpaket. 249.01 ist die schnellste Decode-Zelle der Kampagne. Es ist Cyber-Tiel, nicht der Standard, und verwaltete Lesetests für dieses Paket bleiben ungeklärt.

Auf dem Mac mini M4 Pro 64 GiB beträgt der Abschluss von Tiel python-lru 90.46 gegenüber MTPLX 92.23. AX Code empfiehlt einen M4 Pro mit 48 GB oder mehr für das 35B-Paket. Der M5 Max mit 128 GiB ist der Kampagnenhost, nicht das Minimum. AX Code selbst läuft weiterhin ab 8 GB auf dem M2 mit Cloud- oder leichteren lokalen Modellen.

Nicht mit Qwen 3.8 27B vermischen

Das Erststartpaket von AX Engine ist dichtes Qwen 3.8 27B AXQ 6-bit MTP. Dieses Paket streamt 20.84 GB je Token und steht im direkten AR bereits an der DRAM-Grenze. MTP auf dem Produktpfad ist 31.05 tok/s Decode auf dem Mac mini M4 Pro mit 64 GB (2.43× mlx-lm 12.78) und 76.90 tok/s Decode / 795.3 tok/s Prefill auf dem M5 Max mit 128 GB (2.76× mlx-lm 27.90). Es ist nicht im verwalteten Katalog von AX Code. Zitieren Sie 76.90 nicht neben Tiel 194.88, als wären es dieselbe Metrik oder dasselbe Modell. Siehe Leistung von AX Engine Qwen 27B.

Historischer Schnappschuss vom 19. September auf dem M3 Max

Der Tiel-Benchmark für Prefill und Decode bleibt auf der Platte als nativer Phasenschnappschuss desselben Hosts (M3 Max 128 GiB, Engine-Build als 7.4.0 gekennzeichnet, Median aus drei, AX 47–58 Decode gegenüber MTPLX 92–96). Diese Rangfolge ersetzt die Kampagne vom 20. September auf vier Rechnern nicht. Vermischen Sie die beiden Tabellen nicht.

Sitzungsgeschwindigkeit

Natives Decode mit kurzem Prompt belegt keine Untergrenze für eine Coding-Sitzung mit Zehntausenden Kontexttoken, Tools oder HTTP-Sidecar-Transport. Siehe Lokale Antwortgeschwindigkeit deuten und den erneuten Clienttest von AX Code und OpenCode (Qwen 3.8, ein anderes Modell).