AX Code 받기 · 무료문서

이 페이지는 영어 문서의 번역입니다. 명령, 식별자, 예제는 그대로입니다. 런타임 7.24.5 · SDK 2.6.9. 영어 원문

Tiel / Cyber-Tiel: AX Engine과 MTPLX 비교 (2026년 9월 20일)

상태: 활성 범위: AX Engine 네 대 머신 네이티브 API 캠페인의 공개 요약 최종 검토: 2026-09-21 담당: ax-code 런타임

AX Code는 코딩 에이전트 하네스입니다. AX Engine은 여기에 묶여 제공되는 Apple Silicon 추론 런타임입니다(서명된 7.5.7 사이드카, ax-engine serve). 이 페이지는 현재 맞춰 둔 Tiel 피어 수치를 기록합니다. AX Code README가 9월 19일 M3 Max 스냅샷을 여전히 순위인 것처럼 두지 않게 하기 위해서입니다.

기준 표, 표본 분포, TTFT, 메모리, 재현 절차는 AX Engine에 있습니다.

이 페이지를 그 산출물의 대체물로 보지 마십시오.

무엇을 측정했는가

  • 팩: AutomatosX/AX-Tiel-Coder-35B-A3B-MLX-AXQ-MXFP4-MTP(AX Code 관리 기본값)과 AutomatosX/AX-Cyber-Tiel-Coder-35B-A3B-MLX-AXQ-MXFP4-MTP(대체).
  • 피어: MTPLX 2.11.3 지속 실행, 같은 모델 파일, 같은 프롬프트 토큰 배열.
  • 주 지표: TTFT를 포함한 완료 토큰/초(네이티브 API 진입부터 마지막 콜백까지).
  • 디코드 토큰/초는 첫 콜백을 제외합니다. 주 지표가 아니며 AX Code 세션 속도도 아닙니다.
  • 칸마다 측정 표본 여섯 개, 차가운 KV, MTP 깊이 3, 전체가 상주하는 가중치.
  • 기본 ax-engine serve이 아니며, AX Code 코딩 세션도 아니고, 품질 주장도 아닙니다.

대표 칸 (M5 Max 128 GiB)

팩 워크로드 완료 (AX 대 MTPLX) 디코드 (AX 대 MTPLX)
Tiel (기본) python-lru 194.88 대 177.44 217.85 대 198.40
Cyber-Tiel (대체) python-lru 219.43 대 194.15 249.01 대 219.84

194.88은 관리 기본 팩의 공개 수치입니다. 249.01은 캠페인에서 가장 빠른 디코드 칸입니다. Cyber-Tiel이지 기본값이 아니며, 그 팩에 대한 관리형 읽기 작업 프로브는 아직 해결되지 않았습니다.

Mac mini M4 Pro 64 GiB에서 Tiel python-lru 완료는 90.46 대 MTPLX 92.23입니다. AX Code는 35B 팩에 48 GB 이상의 M4 Pro를 권합니다. M5 Max 128 GiB는 캠페인 호스트이지 최소 사양이 아닙니다. AX Code 자체는 M2 8 GB에서도 클라우드나 더 가벼운 로컬 모델로 실행됩니다.

Qwen 3.8 27B와 섞지 마십시오

AX Engine의 첫 실행 팩은 밀집 Qwen 3.8 27B AXQ 6-bit MTP입니다. 그 팩은 토큰당 20.84 GB를 스트리밍하며, 직접 AR에서는 이미 DRAM 한계에 있습니다. 제품 경로 MTP는 Mac mini M4 Pro 64 GB에서 디코드 31.05 tok/s(mlx-lm 12.78의 2.43배)이고, M5 Max 128 GB에서 디코드 76.90 tok/s / 프리필 795.3 tok/s(mlx-lm 27.90의 2.76배)입니다. AX Code 관리 카탈로그에는 없습니다. 76.90을 Tiel 194.88 옆에, 같은 지표나 같은 모델인 것처럼 인용하지 마십시오. AX Engine Qwen 27B 성능을 보십시오.

2026년 9월 19일 M3 Max 과거 스냅샷

Tiel 프리필/디코드 벤치마크는 같은 호스트의 네이티브 단계 스냅샷으로 디스크에 남아 있습니다(M3 Max 128 GiB, 엔진 빌드 식별 7.4.0, 세 번의 중앙값, AX 디코드 47–58 대 MTPLX 92–96). 그 순위는 9월 20일 네 대 머신 캠페인을 대체하지 않습니다. 두 표를 섞지 마십시오.

세션 속도

짧은 프롬프트의 네이티브 디코드는, 수만 개의 컨텍스트 토큰이나 도구, HTTP 사이드카 전송이 있는 코딩 세션의 하한을 정하지 않습니다. 로컬 응답 속도 해석과 AX Code / OpenCode 클라이언트 재시험(다른 모델인 Qwen 3.8)을 보십시오.