このページは英語版ドキュメントの翻訳です。コマンド、識別子、例はそのままです。ランタイム 7.24.4 · SDK 2.6.7。 英語版
MTPLX と oMLX のローカルランタイム
状態: 有効
範囲: ソースチェックアウトの連携
最終確認: 2026-09-19
担当: ax-code ランタイム
ソースチェックアウトには、別々の MTPLX(mtplx)と oMLX(omlx)のプリセットが、/connect → ローカル LLM ランタイム の下に含まれます。これらのプリセットは v7.19.3 のパッケージ済みバイナリには含まれません。すでに動いているサーバーへ接続します。AX Code はこれらのランタイムをインストール、起動、調整しません。
接続する
- ランタイムを起動し、コーディングツールに対応するモデルを読み込みます。MTPLX の手順 または oMLX の手順 に従ってください。
- AX Code のローカルランタイムメニューで MTPLX または oMLX を選び、サーバーエンドポイントを確認します。
- コーディングに使えるモデルを選びます。モデル ID はサーバーの
GET /v1/models応答から来ます。
| ランタイム | プロバイダー ID | 既定の API エンドポイント | AX Code のホスト上書き |
|---|---|---|---|
| MTPLX | mtplx |
http://localhost:8000/v1 |
MTPLX_HOST |
| oMLX | omlx |
http://localhost:8000/v1 |
OMLX_HOST |
上流の両サーバーは既定でポート 8000 です。一度に 1 つだけ動かすか、異なるポートを割り当て、それらのエンドポイントを別々に保存してください。省略されている場合、AX Code は /v1 を 1 回だけ追加します。保存されたエンドポイントは、ホスト上書きより優先されます。プリセットを一覧に出しても、探査も有効化もしません。既存のプロバイダー有効/無効リストが引き続き権威です。許可リストを使う場合は、他のプロバイダーを外さずに新しい ID を追加してください。
明示的なポートの例:
mtplx serve --model /path/to/your/mtplx-model --host 127.0.0.1 --port 8000
omlx serve --model-dir /path/to/your/models --host 127.0.0.1 --port 8001
起動したサーバーに対応するエンドポイントを使ってください。モデル ID は curl http://localhost:8000/v1/models で調べます(構成に合わせてポートを変えてください)。
コーディングツールと認証
MTPLX のネイティブチャット一覧は、検索モデルとは別に owned_by: "mtplx" と capability: "chat" を識別します。ツールを明示的に無効にしていない限り、AX Code はそのチャット転送をツール利用のために受け入れます。一般的または認識できない一覧は、保守的な既定を保ちます。
oMLX のモデル一覧は、モデルごとのツール対応を宣言せず、チャット以外のモデルを含むことがあります。チャットテンプレートが対応するモデルにだけツールを有効にしてください。サーバーが返した正確なモデル ID に置き換えて、AX Code の設定に次を追加します。
{
"provider": {
"omlx": {
"options": { "baseURL": "http://localhost:8001/v1" },
"models": {
"your-tool-capable-model-id": { "tool_call": true }
}
}
}
}
明示的なツールの選択は発見を越えて残ります。発見された他のモデルはコーディングモデルへ昇格しません。存在する場合、コンテキスト上限には oMLX のネイティブ max_model_len を使います。ランタイムのサンプラー設定、MTP の有効化、サーバー側の出力上限は、ランタイムが所有したままです。
認証が必要なサーバーでは、設定に provider.mtplx.options.apiKey または provider.omlx.options.apiKey を設定します。例は "{env:OMLX_API_KEY}" です。AX Code は、その設定された bearer 資格情報を、推論だけでなく発見にも送ります。ローカルエンドポイントのダイアログはトークンを尋ねません。エンドポイント URL に資格情報を置かないでください。
oMLX における AXQuant Qwen MTP
AXQuant の Qwen MTP パックには、別の mtp.safetensors ヘッドと mtplx_runtime.json 実行契約が含まれます。最近のメタデータには、この 27B パックの 15 個の MTP テンソルを列挙する axquant_omlx_compat.json も含まれます。これらのファイルは互換性を説明します。Lightning MTP をオンにするだけでは、ヘッドはインポートされません。
oMLX 0.6.4 では、完全で書き込み可能なローカルモデルコピーを使います。モデル設定 で MTP サイドカーをインポート を選び、そのあと Lightning MTP を有効にします。上流のインポーターは MTP シャードを準備し、そのローカルコピーのチェックポイント索引を更新します。他のランタイムのために、元のダウンロード済みパックは無傷で残してください。共有の Hugging Face キャッシュスナップショットをその場で編集しないでください。AXQuant のモデル手順 を参照してください。AX Code は準備済みサーバーへ接続し、モデル重みを変更せず、このインポートも行いません。
性能と範囲
ループバックの MTPLX と oMLX の接続は、ローカルのプレフィックス安定性の振る舞いを受けます。決定的なツール順序と、会話履歴のあとの一時コンテキストです。リモートエンドポイントと AX Trust が管理する接続は、既存の振る舞いを保ちます。クラウドと AX Trust の設定は、これらのプリセットでは変わりません。
ローカルプレフィックス修正後の、MTP を有効にした完全な行列については、AX Code/OpenCode クライアントの再テスト を参照してください。ハードウェア、バージョン、モデル識別、キャッシュ状態、タイミングの定義、コードチェックが含まれます。以前のランタイム測定 は、ネイティブデコードの再生と履歴上のクライアント結果を保持します。動く OpenAI 互換接続は、モデルのコーディング品質を確立せず、デコード速度も保証しません。