Dapatkan AX Code · GratisDokumentasi

Halaman ini diterjemahkan dari dokumentasi bahasa Inggris. Perintah, pengenal, dan contoh tidak diubah. Runtime 7.24.4 · SDK 2.6.7. Sumber bahasa Inggris

Konfigurasi dan diagnostik kinerja

Status: Aktif

Cakupan: keadaan saat ini

Terakhir ditinjau: 2026-09-13

Pemilik: ax-code runtime

Pilih profil alat

Untuk sesi pengodean yang tidak memerlukan operasi infrastruktur, penjadwalan, pembuatan gambar, atau analisis khusus, atur toolProfile ke coding untuk penyedia yang terhubung di konfigurasi AX Code Anda:

{
  "provider": {
    "your-provider-id": {
      "options": {
        "toolProfile": "coding"
      }
    }
  }
}

Ganti your-provider-id dengan ID penyedia yang terhubung. Ini mempertahankan inspeksi dan penyuntingan berkas, kerja shell dan latar belakang, delegasi, notebook, tujuan, skills, memori, dan verifikasi tinjauan. Alat web dan alat opsional tetap mengikuti aturan pengaktifan dan izin yang ada. Alat khusus dan MCP mempertahankan aturan penerimaan yang ada dan dapat menambah ukuran permintaan.

Gunakan full ketika Anda memerlukan council/arena, operasi, penjadwalan, pembuatan gambar, atau alat analisis khusus. Penyedia cloud secara bawaan memakai full; AX Engine mempertahankan bawaan core yang lebih kecil. coding tidak mengubah upaya penalaran, izin, penangkapan snapshot, atau persyaratan verifikasi. Efeknya pada kecepatan dan keberhasilan tugas bergantung pada model dan beban kerja. Lihat Upaya model untuk kontrol penalaran yang eksplisit.

Pisahkan persiapan lokal dari waktu respons penyedia

Aktifkan pemrofilan lokal untuk suatu eksekusi:

AX_CODE_PROFILE_NATIVE=1 ax-code run --model your-provider-id/your-model "Your task"
ax-code session replay YOUR_SESSION_ID --mode export

Profil keluar di stderr mencakup rentang session.insertReminders, session.preparePromptRequest, session.preflight, session.resolveTools, dan snapshot track/patch. Ini pengukuran agregat; rentang bersarang atau tumpang tindih tidak boleh dijumlahkan sebagai waktu dinding tugas. Pemrofilan sendiri menambah overhead pengukuran.

Peristiwa llm.response yang tercatat mendapat objek timing opsional:

Bidang Arti
boundary provider-adapter: diamati di adaptor model, sebelum penanganan hasil alat SDK
attempt Nomor percobaan adaptor dalam panggilan LLM.stream ini; bidang lain menggambarkan percobaan ini
setupMs Waktu dari masuk ke LLM.stream sampai pengiriman adaptor ini; pada percobaan ulang mencakup percobaan sebelumnya dan penundaan
firstContentMs Pengiriman sampai delta teks, penalaran, atau masukan alat yang tidak kosong pertama, atau panggilan alat yang lengkap
firstTextMs Pengiriman sampai delta teks tidak kosong pertama; tidak ada untuk respons hanya-alat atau hanya-penalaran
streamMs Pengiriman sampai bingkai selesai adaptor; tidak ada ketika tidak ada bingkai selesai yang diamati

Bingkai metadata dan awal aliran tidak dihitung sebagai konten. Waktu memakai jam monoton dan mencerminkan kapan potongan diamati, termasuk tekanan balik aliran. Ini bukan waktu jaringan mentah, waktu inferensi server, atau waktu render TUI. Adaptor CLI dapat mencakup kerja CLI anak itu sendiri. latencyMs yang ada mempertahankan waktu langkah campuran yang lebih lama dan dapat mencakup eksekusi alat serta kerja snapshot. Bidang waktu baru hanya berisi durasi dan identitas percobaan.

Tanpa AX_CODE_PROFILE_NATIVE=1, objek waktu tambahan dihilangkan. Pemrofilan memakai diagnostik lokal dan log peristiwa sesi yang ada; ia tidak mengaktifkan pengekspor telemetri eksternal.

Untuk perbandingan yang berguna, tahan tugas, revisi repositori, titik akhir penyedia, model persis, upaya penalaran, izin alat, dan kondisi cache agar tetap. Catat waktu respons terlihat pertama dan waktu sampai hasil terverifikasi, termasuk tes dan percobaan perbaikan. Permintaan yang lebih kecil atau snapshot lokal yang lebih cepat saja tidak menetapkan penyelesaian tugas cloud yang lebih cepat.

Gunakan kendali harness dan evaluasi terverifikasi untuk mencoba pemulihan konteks, penemuan MCP, resep hanya-baca, dan perbandingan fixture yang disetarakan dengan verifikasi independen.

Pahami ukuran permintaan

Peristiwa llm.request baru di ax-code session replay YOUR_SESSION_ID --mode export mencakup requestBytes ketika provenans permintaan tersedia:

Bidang Arti
encoding canonical-json-utf8: panjang byte representasi sidik jari kanonik yang ada
system Larik pesan sistem yang dirakit secara terpisah
messages Larik pesan lengkap yang dirakit, termasuk pesan sistem
toolDefinitions Nama alat aktif, deskripsi, dan skema masukan yang terselesaikan

system sudah terwakili di dalam messages; jangan jumlahkan keduanya. Pembingkaian larik disertakan. Nilai biner memakai representasi digest yang ada, jadi ukuran ini bukan ukuran muatan jaringan maupun pengukuran memori tetap. Mereka bukan jumlah token: pemakaian token penyedia dan penghitung cache tetap menjadi sumber akuntansi masukan model. Ringkasan paket konteks mencakup tahap yang lebih sempit dan bukan total masukan model. Peristiwa warisan menghilangkan bidang ini; provenans yang gagal tetap secara eksplisit tidak tersedia.

Hanya ukuran serta hash dan metadata yang ada yang dicatat diagnostik ini. Tidak ada isi prompt atau kredensial tambahan yang disimpan. Ia memakai ulang serialisasi kanonik yang diperlukan setiap hash, bukan menokenisasi permintaan. Bandingkan ukuran pada giliran yang setara ketika memutuskan apakah instruksi sistem, definisi alat, atau riwayat yang tumbuh perlu perhatian. Profil pengodean di atas dapat mengurangi definisi alat tanpa mengubah upaya penalaran; penuh tetap tersedia untuk kapabilitas yang ditambahkannya.

Hindari penjelajahan yang berulang

Untuk pencarian berkas yang diketahui atau hitungan sederhana, gunakan pencarian terfokus atau satu perintah agregat. Selesaikan jalur terhadap direktori workspace saat ini; sesi yang dimulai di dalam paket sudah memiliki paket itu sebagai akar pencarian. Grep bawaan memakai sintaksis regex bawaan ripgrep tanpa lookaround atau rujukan balik.

Gunakan satu penyelidik untuk satu jalur panggilan. Tugas hanya-baca paralel sebaiknya punya hasil yang berbeda dan jalur atau subsistem yang dimiliki, dengan bukti yang ada disertakan dalam ringkasannya. Tinjauan independen dapat meninjau ulang bukti untuk pertanyaan verifikasi yang terpisah. Mengulang penemuan di beberapa konteks baru menghabiskan putaran model bahkan ketika cache bukti mengenai; kena cache tidak melewati validasi konten saat ini atau izin.

Server bahasa kini mulai sesuai permintaan secara bawaan. Lihat Pemakaian memori untuk ikut serta pemanasan spekulatif dan pertukarannya dengan latensi kueri semantik pertama. Panduan prompt dan tes lokal tidak menetapkan pengurangan tertentu pada panggilan model langsung atau RAM fisik.