本頁譯自英文文件。指令、識別名稱與範例保持原樣。執行環境 7.24.4 · SDK 2.6.7。 英文原文
效能設定與診斷
狀態:有效
範圍:現行狀態
上次審閱:2026-09-13
負責人:ax-code runtime
選擇工具設定檔
對於不需要基礎設施維運、排程、影像產生或專門分析的程式工作階段,
在 AX Code 設定中,把已連接供應商的 toolProfile 設為 coding:
{
"provider": {
"your-provider-id": {
"options": {
"toolProfile": "coding"
}
}
}
}
把 your-provider-id 換成已連接的供應商 ID。這會保留檔案檢查與編輯、shell 與背景
工作、委派、筆記本、目標、技能、記憶體與審閱驗證。網頁工具與選用工具仍遵循
既有的啟用與權限規則。自訂與 MCP 工具保留既有的准入規則,也可能增加
請求大小。
當你需要 council/arena、維運、排程、影像產生或專門分析工具時,使用 full。雲端
供應商預設為 full;AX Engine 維持較小的 core 預設。coding 不會改變推理努力程度、
權限、快照擷取或驗證要求。它對速度與任務成功率的影響取決於模型
與工作負載。明確的推理控制見 模型努力程度。
把本機準備與供應商回應時間分開
為一次執行啟用本機剖析:
AX_CODE_PROFILE_NATIVE=1 ax-code run --model your-provider-id/your-model "Your task"
ax-code session replay YOUR_SESSION_ID --mode export
stderr 上的結束設定檔包含 session.insertReminders、session.preparePromptRequest、session.preflight、
session.resolveTools,以及快照 track/patch 區間。這些是彙總測量;巢狀或重疊的區間
不可加總當成任務的牆鐘時間。剖析本身會增加測量負擔。
已記錄的 llm.response 事件會多一個可選的 timing 物件:
| 欄位 | 意義 |
|---|---|
boundary |
provider-adapter:在模型轉接器觀察到,位於 SDK 工具結果處理之前 |
attempt |
這次 LLM.stream 呼叫中的轉接器嘗試次數;其他欄位描述這次嘗試 |
setupMs |
從進入 LLM.stream 到這次轉接器分派的時間;重試時包含先前嘗試與退避 |
firstContentMs |
從分派到第一個非空的文字、推理或工具輸入增量,或完整的工具呼叫 |
firstTextMs |
從分派到第一個非空文字增量;純工具或純推理回應則沒有 |
streamMs |
從分派到轉接器的結束框;未觀察到結束框則沒有 |
中繼資料與串流開始框不算內容。時間使用單調時鐘,反映區塊被
觀察到的時刻,包含任何串流背壓。它們不是原始網路時間、伺服器推論時間或 TUI 繪製
時間。CLI 轉接器可以包含子 CLI 自己的工作。既有的 latencyMs 保留較舊的混合步驟計時,
而且可以包含工具執行與快照工作。新的計時欄位只包含持續時間與嘗試身分。
沒有 AX_CODE_PROFILE_NATIVE=1 時,會省略額外的計時物件。剖析使用本機診斷與
既有的工作階段事件日誌;它不會啟用外部遙測匯出器。
若要做有用的比較,請固定任務、儲存庫修訂、供應商端點、確切模型、推理努力程度、工具 權限與快取條件。記錄首次可見回應時間,以及到達已驗證結果的時間,包含 測試與修復嘗試。較小的請求或較快的本機快照,本身並不能證明雲端任務完成得更快。
使用 控管項目與已驗證評估 來嘗試上下文復原、MCP 探索、唯讀 配方,以及帶有獨立驗證的配對測試樣本比較。
理解請求大小
新的 llm.request 事件,位於 ax-code session replay YOUR_SESSION_ID --mode export,在請求來源可用時包含 requestBytes:
| 欄位 | 意義 |
|---|---|
encoding |
canonical-json-utf8:既有正規化指紋表示法的位元組長度 |
system |
另行組裝的系統訊息陣列 |
messages |
完整組裝的訊息陣列,包含系統訊息 |
toolDefinitions |
作用中的工具名稱、說明與已解析的輸入結構描述 |
system 已經包含在 messages 之中;不要把它們加在一起。陣列框架已計入。二進位值使用既有的摘要表示,因此這些大小既不是網路承載大小,也不是常駐記憶體測量。它們不是 token 數量:供應商 token 用量與快取計數器仍是模型輸入記帳的來源。上下文套件摘要涵蓋較窄的階段,不是模型輸入總量。舊事件省略這個欄位;失敗的來源追溯會明確標成不可用。
這項診斷只記錄大小與既有的雜湊與中繼資料。不會額外儲存提示本文或憑證。它重用每個雜湊所需的正規化序列化,而不是把請求做 token 化。在決定系統指示、工具定義或不斷增長的歷史是否需要注意時,請在對應的回合比較大小。上面的程式設定檔可以減少工具定義,而不改變推理努力程度;完整設定檔仍可用於它額外提供的能力。
避免多餘的探索
對於已知檔案查詢或簡單計數,使用聚焦搜尋或一條彙總指令。依目前工作區目錄解析路徑;在套件內啟動的工作階段,已經以該套件為搜尋根目錄。內建 grep 使用 ripgrep 的預設正則語法,不含環顧或反向參照。
一條呼叫路徑使用一個調查者。平行的唯讀任務應有不同的交付物,以及各自擁有的路徑或子系統,並在任務簡報中提供既有證據。獨立審閱可以為另一個驗證問題重新檢視證據。在多個全新上下文中重複探索,即使證據快取命中,仍會消耗模型回合;快取命中不會略過目前內容驗證或權限。
語言伺服器現在預設依需求啟動。推測性預熱的選擇加入,以及與第一次語意查詢延遲的取捨,見 記憶體用量。提示指引與本機測試並不能證明線上模型呼叫或實體 RAM 有特定幅度的減少。