Esta página es una traducción de la documentación en inglés. Los comandos, identificadores y ejemplos no cambian. Runtime 7.24.5 · SDK 2.6.9. Original en inglés
Tiel / Cyber-Tiel: AX Engine frente a MTPLX (20 de septiembre de 2026)
Estado: Activo Alcance: resumen público de la campaña de API nativa de AX Engine en cuatro máquinas Última revisión: 2026-09-21 Responsable: entorno de ejecución de ax-code
AX Code es el harness del agente de programación. AX Engine es el entorno de ejecución de inferencia para Apple Silicon que
incluye (sidecar firmado 7.5.7, ax-engine serve). Esta página registra las cifras actuales
de pares de Tiel emparejadas para que el README de AX Code no conserve la instantánea del M3 Max del 19 de septiembre
como si siguiera siendo la clasificación.
Las tablas canónicas, la dispersión de muestras, el TTFT, la memoria y la reproducción viven en AX Engine:
No trates esta página como sustituto de esos artefactos.
Qué se midió
- Paquetes:
AutomatosX/AX-Tiel-Coder-35B-A3B-MLX-AXQ-MXFP4-MTP(predeterminado gestionado de AX Code) yAutomatosX/AX-Cyber-Tiel-Coder-35B-A3B-MLX-AXQ-MXFP4-MTP(alternativo). - Par: MTPLX 2.11.3 sostenido, los mismos archivos de modelo y los mismos arrays de tokens del prompt.
- Métrica principal: tokens/s de finalización, incluido el TTFT (entrada de la API nativa hasta la última devolución de llamada).
- Los tokens/s de decode excluyen la primera devolución de llamada. No es la métrica principal ni la velocidad de una sesión de AX Code.
- Seis muestras medidas por celda, KV en frío, profundidad MTP 3, pesos residentes por completo.
- No es el
ax-engine servepredeterminado, no es una sesión de programación de AX Code y no es una afirmación de calidad.
Celdas principales (M5 Max 128 GiB)
| Paquete | Carga | Finalización (AX frente a MTPLX) | Decode (AX frente a MTPLX) |
|---|---|---|---|
| Tiel (predeterminado) | python-lru | 194.88 frente a 177.44 | 217.85 frente a 198.40 |
| Cyber-Tiel (alternativo) | python-lru | 219.43 frente a 194.15 | 249.01 frente a 219.84 |
194.88 es la cifra pública del paquete predeterminado gestionado. 249.01 es la celda de decode más rápida de la campaña; es Cyber-Tiel, no el predeterminado, y las sondas gestionadas de tareas de lectura de ese paquete siguen sin resolverse.
En un Mac mini M4 Pro de 64 GiB, la finalización de Tiel python-lru es 90.46 frente a 92.23 de MTPLX.
AX Code recomienda un M4 Pro con 48 GB o más para el paquete de 35B; el M5 Max de 128 GiB es
el host de la campaña, no el mínimo. AX Code en sí sigue ejecutándose desde 8 GB en un M2 con modelos
en la nube o locales más ligeros.
No lo mezcles con Qwen 3.8 27B
El paquete de primer arranque de AX Engine es el denso Qwen 3.8 27B AXQ 6-bit MTP. Ese paquete transmite 20.84 GB por token y ya está en el techo de DRAM en AR directo. El MTP de la ruta del producto es 31.05 tok/s de decode en Mac mini M4 Pro 64 GB (2.43× mlx-lm 12.78) y 76.90 tok/s de decode / 795.3 tok/s de prefill en M5 Max 128 GB (2.76× mlx-lm 27.90). No está en el catálogo gestionado de AX Code. No cites 76.90 junto a Tiel 194.88 como si fueran la misma métrica o el mismo modelo. Consulta rendimiento de Qwen 27B en AX Engine.
Instantánea histórica del M3 Max del 19 de septiembre
Referencia de prefill y decode de Tiel permanece en disco como una instantánea de fase nativa en el mismo host (M3 Max 128 GiB, compilación del motor identificada como 7.4.0, mediana de tres, decode de AX 47–58 frente a MTPLX 92–96). Esa clasificación no sustituye a la campaña de cuatro máquinas del 20 de septiembre. No mezcles las dos tablas.
Velocidad de sesión
El decode nativo con prompts cortos no establece un suelo para una sesión de programación con decenas de miles de tokens de contexto, herramientas o transporte de sidecar HTTP. Consulta interpretar la velocidad de respuesta local y la repetición de pruebas del cliente AX Code / OpenCode (Qwen 3.8, un modelo distinto).