このページは英語版ドキュメントの翻訳です。コマンド、識別子、例はそのままです。ランタイム 7.24.4 · SDK 2.6.7。 英語版
パフォーマンス設定と診断
状態: 有効
範囲: 現行状態
最終確認: 2026-09-13
担当: ax-code runtime
ツールプロファイルを選ぶ
インフラ運用、スケジュール、画像生成、専門分析が不要なコーディングセッションでは、接続済みプロバイダーについて AX Code の設定で toolProfile を coding にしてください。
{
"provider": {
"your-provider-id": {
"options": {
"toolProfile": "coding"
}
}
}
}
your-provider-id は接続済みプロバイダー ID に置き換えてください。ファイルの検査と編集、シェルとバックグラウンド作業、委譲、ノートブック、ゴール、スキル、メモリ、レビュー検証は残ります。Web ツールと任意ツールは、既存の有効化と権限の規則に従います。カスタムツールと MCP ツールは既存の受付規則を保ち、リクエストサイズに加算できます。
council/arena、運用、スケジュール、画像生成、専門分析のツールが必要なときは full を使ってください。クラウドプロバイダーの既定は full です。AX Engine はより小さい core の既定を保ちます。coding は推論の努力、権限、スナップショット取得、検証要件を変えません。速度とタスク成功への影響は、モデルと作業負荷によって変わります。明示的な推論制御は モデル努力 を参照してください。
ローカル準備とプロバイダー応答時間を分ける
実行のローカルプロファイリングを有効にします。
AX_CODE_PROFILE_NATIVE=1 ax-code run --model your-provider-id/your-model "Your task"
ax-code session replay YOUR_SESSION_ID --mode export
stderr の終了プロファイルには session.insertReminders、session.preparePromptRequest、session.preflight、session.resolveTools、およびスナップショットの track/patch 区間が含まれます。これらは集計値です。入れ子や重なる区間を、タスクの壁時計時間として足し合わせないでください。プロファイリング自体が計測のオーバーヘッドを加えます。
記録された llm.response イベントには、任意の timing オブジェクトが付きます。
| フィールド | 意味 |
|---|---|
boundary |
provider-adapter: モデルアダプターで観測。SDK のツール結果処理より前です |
attempt |
この LLM.stream 呼び出しの中でのアダプター試行番号。他のフィールドはこの試行を表します |
setupMs |
LLM.stream への入口から、このアダプターディスパッチまでの時間。再試行時は以前の試行とバックオフを含みます |
firstContentMs |
ディスパッチから、空でない最初のテキスト、推論、またはツール入力の差分、あるいは完了したツール呼び出しまで |
firstTextMs |
ディスパッチから、空でない最初のテキスト差分まで。ツールのみ、または推論のみの応答では欠落します |
streamMs |
ディスパッチから、アダプターの終了フレームまで。終了フレームが観測されないときは欠落します |
メタデータとストリーム開始フレームは内容として数えません。時刻は単調時計を使い、チャンクが観測された時点を表します。ストリームのバックプレッシャーも含みます。生のネットワーク時刻、サーバー推論時刻、TUI の描画時刻ではありません。CLI アダプターは子 CLI 自身の作業を含められます。既存の latencyMs は古い混在ステップ時刻を保ち、ツール実行とスナップショット作業を含められます。新しい時刻フィールドが含むのは、所要時間と試行の識別だけです。
AX_CODE_PROFILE_NATIVE=1 がないときは、追加の時刻オブジェクトは省略されます。プロファイリングはローカル診断と既存のセッションイベントログを使います。外部テレメトリのエクスポーターは有効にしません。
比較を有効にするには、タスク、リポジトリのリビジョン、プロバイダーのエンドポイント、正確なモデル、推論の努力、ツール権限、キャッシュ条件を一定に保ってください。最初に見える応答までの時間と、テストと修復の試行を含む検証済み結果までの時間を記録してください。リクエストが小さいこと、またはローカルスナップショットが速いことだけでは、クラウドタスクの完了が速いとは言えません。
コンテキスト回復、MCP の発見、読み取り専用レシピ、独立検証付きの一致フィクスチャ比較を試すには、ハーネス制御と検証済み評価 を使ってください。
リクエストサイズを理解する
新しい llm.request イベントは ax-code session replay YOUR_SESSION_ID --mode export にあり、リクエストの来歴が得られるとき requestBytes を含みます。
| フィールド | 意味 |
|---|---|
encoding |
canonical-json-utf8: 既存の正規フィンガープリント表現のバイト長 |
system |
別に組み立てられたシステムメッセージ配列 |
messages |
システムメッセージを含む、組み立て済みメッセージ配列の全体 |
toolDefinitions |
有効なツール名、説明、解決済み入力スキーマ |
system はすでに messages の中に表されています。足し合わせないでください。配列の枠組みは含まれます。バイナリ値は既存のダイジェスト表現を使うため、これらのサイズはネットワークペイロードのサイズでも常駐メモリの計測でもありません。トークン数でもありません。プロバイダーのトークン使用量とキャッシュカウンタが、モデル入力の会計の情報源です。コンテキストパックの要約はより狭い段階を扱い、モデル入力の合計ではありません。レガシーイベントはこのフィールドを省きます。来歴の失敗は、明示的に利用不可のままです。
この診断が記録するのは、サイズと既存のハッシュおよびメタデータだけです。追加のプロンプト本文や資格情報は保存しません。リクエストをトークン化するのではなく、各ハッシュに必要な正規シリアライズを再利用します。システム指示、ツール定義、伸びる履歴に注意が必要かを決めるときは、対応するターンのサイズを比較してください。上のコーディングプロファイルは、推論の努力を変えずにツール定義を減らせます。追加する能力のために full は引き続き使えます。
余分な探索を避ける
既知ファイルの検索や単純な件数なら、焦点を絞った検索か、1 つの集計コマンドを使ってください。パスは現在のワークスペースディレクトリに対して解決してください。パッケージの中で始めたセッションは、そのパッケージを検索ルートとしてすでに持っています。組み込み grep は ripgrep の既定の正規表現構文を使い、先読みと後方参照はありません。
1 つの呼び出し経路には 1 人の調査役を使ってください。並列の読み取り専用タスクは、別々の成果物と、所有するパスまたはサブシステムを持ち、既存の証拠をブリーフに含めてください。独立したレビューは、別の検証質問のために証拠を再訪できます。複数の新しいコンテキストで発見を繰り返すと、証拠キャッシュが当たってもモデルのラウンドを消費します。キャッシュヒットは、現在の内容の検証や権限を迂回しません。
言語サーバーは、既定で要求時に起動するようになりました。投機的な事前ウォームのオプトインと、最初のセマンティッククエリ遅延とのトレードオフは メモリ使用量 を参照してください。プロンプトの指針とローカルテストは、ライブのモデル呼び出しや物理 RAM の特定の削減を証明しません。