Esta página es una traducción de la documentación en inglés. Los comandos, identificadores y ejemplos no cambian. Runtime 7.24.4 · SDK 2.6.7. Original en inglés
Evidencia de ejecución
Estado: Activo Alcance: estado actual Última revisión: 2026-08-25 Responsable: entorno de ejecución de AX Code
Cada sesión de AX Code se registra mientras se ejecuta. Esta página cubre los comandos que convierten ese registro en algo que puedes revisar, comparar, exportar y deshacer.
Úsala cuando un agente haya terminado y necesites responder: qué hizo, qué riesgo tuvo, cómo se comparó con otro intento y cómo vuelvo atrás.
Qué se registra
Durante una ejecución AX Code escribe dos cosas independientes:
- Un registro de eventos tipado — decisiones de enrutado, actividad del modelo, límites de paso, llamadas a herramientas y resultados de herramientas. Es la fuente de
graph,replay,compare,traceyaudit. - Instantáneas de archivos — capturadas en un almacén de objetos de Git que vive fuera de tu repositorio, bajo el directorio de datos de AX Code, usando
refs/snapshots/<hash>. Tu árbol de trabajo y el.git/de tu proyecto no se modifican para almacenarlas.
Ambas son locales. No se sube nada.
Reconstruir una ejecución
ax-code graph <sessionID>
Reconstruye la sesión como un grafo de ejecución: duración, resumen de riesgo, recuentos de tokens, agentes usados y cada paso con sus llamadas a herramientas y tiempos.
## Session ses_01H8XK
Duration: 9m 54s | Risk: HIGH (53/100) | Tokens: 167,650 in / 18,494 out
Agents: architect
### Step 1 (8s) | tokens: 12263/587
- read: api.ts → ok (5ms)
- grep: rateLimit → ok (12ms)
--format selecciona salidas alternativas, incluidas Mermaid y una vista de topología, cuando quieras el grafo en otra herramienta.
Ten en cuenta que este es el grafo de ejecución de la sesión: lo que hizo el agente. No es el grafo de código del repositorio; ese es ax-code index y la capa de inteligencia de código.
Comparar dos ejecuciones
ax-code session compare <sessionA> <sessionB>
ax-code session compare <sessionA> <sessionB> --deep
Informa el delta de riesgo, los archivos cambiados, los recuentos de fallos de herramientas, la ruta de decisión que tomó cada ejecución y los recuentos por tipo de evento. --deep añade análisis de divergencia a nivel de paso mediante comparación de reproducción.
Esto compara ejecuciones, no código fuente. Responde a «el segundo intento puntuó peor: dónde divergió», no a «muéstrame el diff del código».
Un uso típico es decidir entre dos estrategias para la misma tarea:
Risk Comparison
----------------------------------------
Score: 53 → 93 (+40) ↑
Level: HIGH → CRITICAL
Files: 8 → 25
Failures: 0 → 15
Inspeccionar el registro de eventos grabado
ax-code session replay <sessionID> --mode summary
ax-code session replay <sessionID> --mode verify
ax-code session replay <sessionID> --mode reconstruct
ax-code session replay <sessionID> --mode export
verify comprueba la coherencia del registro grabado. reconstruct reconstruye el flujo de pasos a partir de los eventos. export escribe un paquete de reproducción portable.
La reproducción reconstruye; no vuelve a ejecutar. No vuelve a ejecutar modelos, no vuelve a invocar herramientas ni reproduce el estado externo. El modo execute prepara un flujo reconstruido para compararlo de forma programática con el original y está pensado para pruebas, no para volver a ejecutar el trabajo.
Leer las señales de riesgo
ax-code risk <sessionID>
ax-code risk <sessionID> --explain
ax-code risk <sessionID> --json
La puntuación es una heurística determinista derivada de señales registradas, incluido cuántos archivos cambiaron, si el cambio abarca varias áreas de nivel superior, cuántas llamadas a herramientas fallaron, si se ejecutó la validación, si existe una instantánea del diff, cuánta superficie de API se ve afectada, cómo terminó la ejecución (una puerta de finalización bloqueada o un final por límite de pasos o por atasco añaden peso) y si se tocaron rutas sensibles a la seguridad. Cada factor que contribuye se lista con su peso, junto con mitigaciones sugeridas.
Es una ayuda para la revisión. No es una probabilidad, una confianza calibrada ni una afirmación de que el código es seguro. Una puntuación LOW en un cambio no verificado sigue significando que el cambio no está verificado.
Deshacer con precisión
Las instantáneas de archivos funcionan en repositorios Git y en directorios de proyecto ordinarios cuando Git
está instalado y snapshot está activado. AX Code mantiene su almacén Git de instantáneas
fuera de tu proyecto; no crea un directorio .git del proyecto. Siguen aplicándose las reglas de ignorados
y las exclusiones de rutas no admitidas.
Revertir en la TUI deshace mensajes y cambios de archivo capturados. Con snapshot: false, o
en turnos antiguos que nunca capturaron una línea base, solo puede deshacer mensajes; las
ediciones de archivos permanecen en disco. Activar las instantáneas ahora no puede reconstruir contenidos
anteriores de archivos. Un turno capturado sin cambios de archivo tampoco tiene nada que restaurar.
ax-code session rollback <sessionID> --list # show recoverable points
ax-code session rollback <sessionID> --dry-run # show what would change
ax-code session rollback <sessionID> --step 4 # restore one step
ax-code session rollback <sessionID> # restore the whole session
--list combina eventos durables de paso con el detalle del grafo de ejecución, así que puedes apuntar a un paso concreto en lugar de revertir toda la ejecución. --dry-run usa el mismo planificador de reversión que apply y lista las sesiones delegadas cuyo libro de archivos contribuye al resultado.
La reversión sigue las sesiones hijas anidadas cuando escribieron en el directorio de trabajo exacto del padre. Restaura sus cambios de archivo posteriores al límite y conserva sus transcripciones. Los descendientes que se ejecutan en otro worktree o directorio quedan excluidos, y la reversión falla cerrada si alguna sesión incluida sigue en ejecución.
Límites que conviene conocer antes de confiar en ello: la reversión restaura a partir de instantáneas tomadas durante la ejecución. Un archivo que nunca se instantaneó — porque se cambió fuera de la sesión, o no estaba en un estado recuperable — no se puede restaurar así. Usa --dry-run primero en cualquier cosa con consecuencias.
Probar otra estrategia
ax-code session branch <sessionID>
ax-code session branch <sessionID> --from <messageID>
Bifurca el estado almacenado de la sesión para que un segundo intento empiece desde un punto elegido en lugar de desde cero.
Esto bifurca el estado de la sesión: mensajes y objetivos. No es una rama de Git ni un worktree. Para candidatas Git aisladas, consulta cambios verificados con varios modelos.
Diagnosticar
ax-code session trace <sessionID>
ax-code session trace <sessionID> --logs
Diagnósticos respaldados por la reproducción, con una línea de tiempo puntuada por riesgo. --logs cambia al análisis heredado de archivos de registro en lugar de eventos de reproducción, lo que es útil cuando investigas un problema operativo en lugar de revisar un cambio.
Exportar la evidencia
ax-code audit export --all --since 2026-08-01 # JSON Lines
ax-code audit export --all --risk HIGH # filter by minimum risk
ax-code audit report <sessionID> # Markdown report
ax-code audit otlp <sessionID> # OpenTelemetry spans
ax-code audit prune --days 90 # delete old events
JSONL y OTLP hacen que el registro de la ejecución lo pueda consumir tu propio canal de revisión u observabilidad. El informe Markdown está pensado para personas que adjuntan evidencia a una PR o a un registro de cambio.
Explorarlo
ax-code run-report # latest session
ax-code run-report --index # session index
Abre el informe local de la ejecución en un navegador, con el resumen de la ejecución, la línea de tiempo, los cambios, el estado de validación, el detalle de riesgo, la información de rama y los puntos de reversión. El servidor se vincula solo a loopback.
Relacionado
- Garantía de objetivos — comprobaciones de aceptación ejecutables y frescura del código fuente para objetivos largos
- Por qué AX Code — para qué sirve esta capa de evidencia
- Cambios verificados con varios modelos — producir candidatas que merezca comparar
- Capa semántica — sobres de procedencia en respuestas de grafo y LSP
- Informe de ejecución — la vista a nivel de espacio de trabajo y el informe por sesión