取得 AX Code · 免費文件

本頁譯自英文文件。指令、識別名稱與範例保持原樣。執行環境 7.24.5 · SDK 2.6.9。 英文原文

MTPLX 與 oMLX 本機執行環境

狀態:現行

範圍:原始碼工作複本整合

上次審閱:2026-09-19

負責人:ax-code 執行環境

原始碼工作複本包含分開的 MTPLX(mtplx)與 oMLX(omlx)預設組,位於 /connect、再到 Local LLM runtime 之下。這些預設組不包含在 v7.19.3 封裝的二進位檔裡。它們連接的是已經在執行的伺服器;AX Code 不會安裝、啟動或調整這些執行環境。

連接

  1. 啟動你的執行環境,並載入支援程式開發工具的模型。請依照 MTPLX 說明 或 oMLX 說明。
  2. 在 AX Code 的本機執行環境選單中選擇 MTPLX 或 oMLX,並確認伺服器端點。
  3. 選擇具備程式開發能力的模型。模型 ID 來自伺服器的 GET /v1/models 回應。
執行環境 供應商 ID 預設 API 端點 AX Code 的主機覆寫
MTPLX mtplx http://localhost:8000/v1 MTPLX_HOST
oMLX omlx http://localhost:8000/v1 OMLX_HOST

兩個上游伺服器預設都使用連接埠 8000。請一次只跑一個,或指定不同連接埠,並分別儲存那些端點。若省略,AX Code 會附加 /v1 一次。已儲存的端點優先於主機覆寫。列出預設組並不會探測或啟用它。既有的供應商啟用與停用清單仍然具權威;若你使用允許清單,請加入新的 ID,不要移除其他供應商。

明確指定連接埠的範例:

mtplx serve --model /path/to/your/mtplx-model --host 127.0.0.1 --port 8000
omlx serve --model-dir /path/to/your/models --host 127.0.0.1 --port 8001

請使用你所啟動之伺服器對應的端點。用 curl http://localhost:8000/v1/models 查看它的模型 ID(依你的設定更改連接埠)。

程式開發工具與驗證

MTPLX 的原生聊天清單會把 owned_by: "mtplx" 與 capability: "chat" 和檢索模型分開標出。除非它明確停用工具,否則 AX Code 會准入該聊天傳輸以使用工具。一般或無法辨識的清單會保留保守預設。

oMLX 的模型清單不會宣告每個模型的工具支援,而且可能包含非聊天模型。只對聊天範本支援工具的模型啟用工具。把下面這段加到 AX Code 設定,並換成你的伺服器傳回的精確模型 ID:

{
  "provider": {
    "omlx": {
      "options": { "baseURL": "http://localhost:8001/v1" },
      "models": {
        "your-tool-capable-model-id": { "tool_call": true }
      }
    }
  }
}

明確的工具選擇在探索之後仍然保留。其他被探索到的模型不會被提升為程式開發模型。若有 oMLX 原生的 max_model_len,會用來當作上下文上限。執行環境的取樣器設定、MTP 是否啟用,以及伺服器端的輸出上限,仍由該執行環境擁有。

若伺服器需要驗證,請在設定中設定 provider.mtplx.options.apiKey 或 provider.omlx.options.apiKey,例如 "{env:OMLX_API_KEY}"。AX Code 在探索與推理時都會送出該已設定的 bearer 憑證。本機端點對話框不會要求輸入權杖。不要把憑證放在端點 URL 裡。

oMLX 中的 AXQuant Qwen MTP

AXQuant 的 Qwen MTP 套組包含分開的 mtp.safetensors 頭,以及 mtplx_runtime.json 執行契約。較新的中繼資料也包含 axquant_omlx_compat.json,它列出這個 27B 套組的 15 個 MTP 張量。這些檔案描述的是相容性;只開啟 Lightning MTP 並不會匯入這個頭。

對於 oMLX 0.6.4,請使用完整、可寫入的本機模型複本。在 Model Settings 中選擇 Import MTP side-car,然後啟用 Lightning MTP。上游匯入器會準備 MTP 分片,並更新該本機複本的檢查點索引。請保持原本下載的套組完整,供其他執行環境使用;不要就地編輯共用的 Hugging Face 快取快照。請見 AXQuant 模型說明。AX Code 連到已準備好的伺服器,不會修改模型權重,也不會執行這次匯入。

效能與範圍

本機回送的 MTPLX 與 oMLX 連線會套用本機的前綴穩定性行為:確定性的工具排序,以及對話歷史之後的暫時上下文。遠端端點與由 AX Trust 管理的連線保持既有行為;這些預設組不會改變雲端與 AX Trust 的設定。

已啟用 MTP 的完整矩陣,包含本機前綴修正之後的硬體、版本、模型身分、快取狀態、計時定義與程式碼檢查,請見 AX Code 與 OpenCode 用戶端再測。較早的執行環境測量 保留原生 decode 重播與歷史用戶端結果。能用的 OpenAI 相容連線,並不能建立模型的程式開發品質,也不保證 decode 速率。