Esta página é uma tradução da documentação em inglês. Comandos, identificadores e exemplos permanecem iguais. Runtime 7.24.5 · SDK 2.6.9. Original em inglês
Tiel e Cyber-Tiel: AX Engine versus MTPLX (20 de setembro de 2026)
Status: Ativo Escopo: resumo público da campanha de API nativa do AX Engine em quatro máquinas Última revisão: 2026-09-21 Responsável: runtime do ax-code
O AX Code é o harness do agente de programação. O AX Engine é o runtime de inferência para Apple Silicon que ele inclui (sidecar assinado 7.5.7, ax-engine serve). Esta página registra os números comparativos atuais do Tiel, para que o README do AX Code não conserve o instantâneo de 19 de setembro no M3 Max como se ainda fosse a classificação.
As tabelas canônicas, a dispersão das amostras, o TTFT, a memória e a reprodução estão no AX Engine:
Não trate esta página como substituto desses artefatos.
O que foi medido
- Pacotes:
AutomatosX/AX-Tiel-Coder-35B-A3B-MLX-AXQ-MXFP4-MTP(padrão administrado do AX Code) eAutomatosX/AX-Cyber-Tiel-Coder-35B-A3B-MLX-AXQ-MXFP4-MTP(alternativo). - Par: MTPLX 2.11.3 sustentado, os mesmos arquivos de modelo e os mesmos arranjos de tokens do prompt.
- Métrica principal: tokens/s de conclusão, incluindo TTFT (da entrada da API nativa até o último callback).
- Tokens/s de decode excluem o primeiro callback. Não é a métrica principal e não é a velocidade de uma sessão do AX Code.
- Seis amostras medidas por célula, KV frio, profundidade MTP 3 e pesos totalmente residentes.
- Não é o
ax-engine servepadrão, não é uma sessão de programação do AX Code e não é uma alegação de qualidade.
Células de destaque (M5 Max de 128 GiB)
| Pacote | Carga | Conclusão (AX contra MTPLX) | Decode (AX contra MTPLX) |
|---|---|---|---|
| Tiel (padrão) | python-lru | 194.88 contra 177.44 | 217.85 contra 198.40 |
| Cyber-Tiel (alternativo) | python-lru | 219.43 contra 194.15 | 249.01 contra 219.84 |
194.88 é o número público do pacote padrão administrado. 249.01 é a célula de decode mais rápida da campanha; é o Cyber-Tiel, não o padrão, e as sondagens administradas de tarefa de leitura desse pacote continuam sem conclusão.
No Mac mini M4 Pro de 64 GiB, a conclusão do Tiel python-lru é 90.46 contra 92.23 do MTPLX. O AX Code recomenda um M4 Pro com 48 GB ou mais para o pacote de 35B; o M5 Max de 128 GiB é o host da campanha, não o mínimo. O próprio AX Code ainda roda a partir de 8 GB no M2, com modelos de nuvem ou locais mais leves.
Não misture com o Qwen 3.8 27B
O pacote da primeira execução do AX Engine é o Qwen 3.8 27B AXQ 6-bit MTP denso. Esse pacote movimenta 20.84 GB por token e já está no teto de DRAM em AR direto. O MTP no caminho do produto é 31.05 tok/s de decode no Mac mini M4 Pro de 64 GB (2.43× o mlx-lm 12.78) e 76.90 tok/s de decode / 795.3 tok/s de prefill no M5 Max de 128 GB (2.76× o mlx-lm 27.90). Ele não está no catálogo administrado do AX Code. Não cite 76.90 ao lado de 194.88 do Tiel como se fossem a mesma métrica ou o mesmo modelo. Veja Desempenho do Qwen 27B no AX Engine.
Instantâneo histórico de 19 de setembro no M3 Max
A referência de prefill e decode do Tiel permanece em disco como um instantâneo de fase nativa no mesmo host (M3 Max de 128 GiB, compilação do engine identificada como 7.4.0, mediana de três, decode do AX de 47–58 contra 92–96 do MTPLX). Essa classificação não prevalece sobre a campanha de quatro máquinas de 20 de setembro. Não misture as duas tabelas.
Velocidade da sessão
O decode nativo de prompt curto não estabelece um piso para uma sessão de programação com dezenas de milhares de tokens de contexto, ferramentas ou transporte do sidecar HTTP. Veja Interpretar a velocidade local de resposta e o reteste dos clientes AX Code e OpenCode (Qwen 3.8, um modelo diferente).