获取 AX Code · 免费文档

本页译自英文文档。命令、标识符和示例保持原样。运行时 7.24.5 · SDK 2.6.9。 英文原文

Tiel 与 Cyber-Tiel:AX Engine 对比 MTPLX(2026 年 9 月 20 日)

状态:生效 范围:AX Engine 四机原生 API 活动的公开摘要 最近审阅:2026-09-21 负责人:ax-code 运行时

AX Code 是编码智能体框架。AX Engine 是它捆绑的 Apple Silicon 推理运行时(已签名的 7.5.7 附属程序,ax-engine serve)。本页记录当前匹配的 Tiel 对等数字,以免 AX Code README 仍把 9 月 19 日的 M3 Max 快照当作现行排名。

规范表格、样本散布、TTFT、内存和复现位于 AX Engine:

不要把本页当作那些产物的替代。

测量了什么

  • 包:AutomatosX/AX-Tiel-Coder-35B-A3B-MLX-AXQ-MXFP4-MTP(AX Code 受管默认)和 AutomatosX/AX-Cyber-Tiel-Coder-35B-A3B-MLX-AXQ-MXFP4-MTP(备选)。
  • 对等方:MTPLX 2.11.3 持续运行,相同的模型文件,相同的提示 token 数组。
  • 主要指标:包含 TTFT 的完成 token/秒(从原生 API 入口到最后一次回调)。
  • 解码 token/秒排除第一次回调。它不是主要指标,也不是 AX Code 会话速度。
  • 每个单元格六次测量样本,冷 KV,MTP 深度 3,权重完全驻留。
  • 不是默认的 ax-engine serve,不是 AX Code 编码会话,也不是质量主张。

标题单元格(M5 Max 128 GiB)

包 工作负载 完成(AX 对比 MTPLX) 解码(AX 对比 MTPLX)
Tiel(默认) python-lru 194.88 对比 177.44 217.85 对比 198.40
Cyber-Tiel(备选) python-lru 219.43 对比 194.15 249.01 对比 219.84

194.88 是受管默认包的公开数字。249.01 是本次活动中最快的解码单元格;它是 Cyber-Tiel,不是默认包,该包的受管读取任务探测仍未解决。

在 Mac mini M4 Pro 64 GiB 上,Tiel python-lru 的完成速度是 90.46,对比 MTPLX 的 92.23。AX Code 建议 M4 Pro 具备 48 GB 或更多 内存来运行 35B 包;M5 Max 128 GiB 是活动主机,不是最低要求。AX Code 本身在 M2 上从 8 GB 起仍可运行,配合云端或更轻的本地模型。

不要与 Qwen 3.8 27B 混用

AX Engine 的首次运行包是密集的 Qwen 3.8 27B AXQ 6-bit MTP。该包每个 token 流式传输 20.84 GB,在直接自回归中已经处于 DRAM 天花板。产品路径 MTP 在 Mac mini M4 Pro 64 GB 上的解码为 31.05 tok/s(mlx-lm 12.78 的 2.43 倍),在 M5 Max 128 GB 上为 76.90 tok/s 解码 / 795.3 tok/s 预填充(mlx-lm 27.90 的 2.76 倍)。它不在 AX Code 的受管目录中。不要把 76.90 和 Tiel 的 194.88 并列引用,仿佛它们是同一指标或同一模型。见 AX Engine Qwen 27B 性能。

历史上的 9 月 19 日 M3 Max 快照

Tiel 预填充/解码基准 仍作为同一主机的原生阶段快照留在磁盘上(M3 Max 128 GiB,引擎构建自报为 7.4.0,三次的中位数,AX 解码 47–58 对比 MTPLX 的 92–96)。该排名并不取代 9 月 20 日的四机活动。不要混用两张表。

会话速度

短提示的原生解码并不能为带有数万上下文 token、工具或 HTTP 附属传输的编码会话确立下限。见 解读本地响应速度 和 AX Code / OpenCode 客户端复测(Qwen 3.8,另一个模型)。