本页译自英文文档。命令、标识符和示例保持原样。运行时 7.24.5 · SDK 2.6.9。 英文原文
Tiel 与 Cyber-Tiel:AX Engine 对比 MTPLX(2026 年 9 月 20 日)
状态:生效 范围:AX Engine 四机原生 API 活动的公开摘要 最近审阅:2026-09-21 负责人:ax-code 运行时
AX Code 是编码智能体框架。AX Engine 是它捆绑的 Apple Silicon 推理运行时(已签名的 7.5.7 附属程序,ax-engine serve)。本页记录当前匹配的 Tiel 对等数字,以免 AX Code README 仍把 9 月 19 日的 M3 Max 快照当作现行排名。
规范表格、样本散布、TTFT、内存和复现位于 AX Engine:
不要把本页当作那些产物的替代。
测量了什么
- 包:
AutomatosX/AX-Tiel-Coder-35B-A3B-MLX-AXQ-MXFP4-MTP(AX Code 受管默认)和AutomatosX/AX-Cyber-Tiel-Coder-35B-A3B-MLX-AXQ-MXFP4-MTP(备选)。 - 对等方:MTPLX 2.11.3 持续运行,相同的模型文件,相同的提示 token 数组。
- 主要指标:包含 TTFT 的完成 token/秒(从原生 API 入口到最后一次回调)。
- 解码 token/秒排除第一次回调。它不是主要指标,也不是 AX Code 会话速度。
- 每个单元格六次测量样本,冷 KV,MTP 深度 3,权重完全驻留。
- 不是默认的
ax-engine serve,不是 AX Code 编码会话,也不是质量主张。
标题单元格(M5 Max 128 GiB)
| 包 | 工作负载 | 完成(AX 对比 MTPLX) | 解码(AX 对比 MTPLX) |
|---|---|---|---|
| Tiel(默认) | python-lru | 194.88 对比 177.44 | 217.85 对比 198.40 |
| Cyber-Tiel(备选) | python-lru | 219.43 对比 194.15 | 249.01 对比 219.84 |
194.88 是受管默认包的公开数字。249.01 是本次活动中最快的解码单元格;它是 Cyber-Tiel,不是默认包,该包的受管读取任务探测仍未解决。
在 Mac mini M4 Pro 64 GiB 上,Tiel python-lru 的完成速度是 90.46,对比 MTPLX 的 92.23。AX Code 建议 M4 Pro 具备 48 GB 或更多 内存来运行 35B 包;M5 Max 128 GiB 是活动主机,不是最低要求。AX Code 本身在 M2 上从 8 GB 起仍可运行,配合云端或更轻的本地模型。
不要与 Qwen 3.8 27B 混用
AX Engine 的首次运行包是密集的 Qwen 3.8 27B AXQ 6-bit MTP。该包每个 token 流式传输 20.84 GB,在直接自回归中已经处于 DRAM 天花板。产品路径 MTP 在 Mac mini M4 Pro 64 GB 上的解码为 31.05 tok/s(mlx-lm 12.78 的 2.43 倍),在 M5 Max 128 GB 上为 76.90 tok/s 解码 / 795.3 tok/s 预填充(mlx-lm 27.90 的 2.76 倍)。它不在 AX Code 的受管目录中。不要把 76.90 和 Tiel 的 194.88 并列引用,仿佛它们是同一指标或同一模型。见 AX Engine Qwen 27B 性能。
历史上的 9 月 19 日 M3 Max 快照
Tiel 预填充/解码基准 仍作为同一主机的原生阶段快照留在磁盘上(M3 Max 128 GiB,引擎构建自报为 7.4.0,三次的中位数,AX 解码 47–58 对比 MTPLX 的 92–96)。该排名并不取代 9 月 20 日的四机活动。不要混用两张表。
会话速度
短提示的原生解码并不能为带有数万上下文 token、工具或 HTTP 附属传输的编码会话确立下限。见 解读本地响应速度 和 AX Code / OpenCode 客户端复测(Qwen 3.8,另一个模型)。