Esta página es una traducción de la documentación en inglés. Los comandos, identificadores y ejemplos no cambian. Runtime 7.24.4 · SDK 2.6.7. Original en inglés
Selección y recuperación de modelos
Estado: Activo Alcance: estado actual Última revisión: 2026-10-10 Responsable: entorno de ejecución de ax-code
AX Code conserva las selecciones exactas de proveedor y modelo. Conectar un proveedor no lo añade a un grupo de recuperación automática. Sin un respaldo configurado, los fallos transitorios reintentan el objetivo seleccionado dentro del límite de reintentos existente y después se detienen.
Configurar un respaldo ordenado
Define llm_routing.fallback en la configuración de usuario, en una configuración personalizada elegida por AX_CODE_CONFIG o con un AX_CODE_CONFIG_CONTENT explícito. Los objetivos son pares exactos; los identificadores de modelo pueden contener barras. Por ejemplo:
{
"model": "my-gateway/openai/gpt-oss-120b",
"llm_routing": {
"fallback": [
{ "providerID": "my-gateway", "modelID": "my-backup-model" },
{ "providerID": "my-other-provider", "modelID": "my-approved-model" }
]
}
}
Sustituye estos ejemplos por identificadores exactos de tus proveedores configurados. La lista admite hasta ocho objetivos distintos. Vacía o ausente significa que el objetivo no cambia. La configuración del proyecto y la remota pueden estrechar las concesiones del usuario, pero no pueden añadirlas ni reordenarlas. Las restricciones gestionadas fijan un techo final. Si falta el siguiente objetivo configurado, la recuperación se detiene; AX Code no sustituye otra entrada del catálogo.
Los límites de tasa transitorios ordinarios, la sobrecarga reconocida y los errores de servidor pueden avanzar por esta lista después de los reintentos sobre el mismo objetivo. Los fallos de autenticación, de permiso, de cuota permanente y de solicitud no válida no autorizan un cambio. Las sesiones de un proveedor local no migran automáticamente a la inferencia remota. La cancelación detiene la secuencia. La recuperación también se detiene cuando la solicitud actual publica salida o inicia una herramienta, para conservar el progreso parcial en lugar de repetir los efectos.
El procesador permite normalmente cinco reintentos sobre el mismo objetivo después del intento inicial; los errores de límite de concurrencia tienen un tope de ocho reintentos. Los interruptores de circuito del proveedor y los límites de error externos pueden detenerse antes. Los pasos correctos del bucle de herramientas son solicitudes nuevas, no reintentos del trabajo anterior. Los reintentos del AI SDK están desactivados en los puntos de generación directa controlados. Los intentos internos de una CLI externa y de la pasarela pueden seguir siendo opacos.
Trabajo auxiliar y configuración existente
Sin small_model, el título, el resumen y la compactación heredan el modelo principal. Un small_model explícito o un modelo de agente específico del rol sigue eligiendo ese objetivo exacto. Los anclajes no válidos fallan en lugar de pasar a otro proveedor o modelo. El trabajo opcional de título y resumen conserva su comportamiento de título local o de omisión. La compactación conserva la transcripción cuando falla y solo cambia de modelo mediante la recuperación configurada.
Los modelos principales configurados, los anclajes de tarea, agente y comando, y las selecciones recientes guardadas también permanecen exactos. Elimina o corrige de forma explícita un anclaje que no esté disponible. Las ejecuciones sin interfaz, sin selección configurada ni reciente, exigen --model. El selector de modelo visible puede ofrecer recomendaciones, pero esas sugerencias no se convierten en una lista de recuperación.
El clasificador de complejidad opcional exige un modelo auxiliar explícito; sin uno, la clasificación se omite. Queda anclado al proveedor solicitado cuando se aporta un modelo principal. Las elecciones principales explícitas sobreviven al enrutado por tema del agente.
Inspeccionar la configuración efectiva
ax-code debug routing
ax-code debug routing --model my-gateway/openai/gpt-oss-120b
Esto imprime el modelo principal exacto, el respaldo ordenado, la selección auxiliar, los anclajes de agente y el límite de reintentos. No envía una solicitud de modelo ni sondea la disponibilidad del modelo. La carga normal de la configuración puede obtener los ajustes remotos configurados. Es una explicación de la configuración, no una reconstrucción del comportamiento pasado de la pasarela.
Los mensajes del usuario registran si la selección vino de una solicitud, de un anclaje de agente, del enrutado por complejidad o híbrido, o de los valores predeterminados de la sesión y de la configuración. Esta fuente describe el ingreso local; request no atestigua quién operó un cliente de API. La evidencia de la solicitud registra el propósito y el objetivo seleccionados. Las autodescripciones generadas por el modelo y los nombres de modelo en la memoria o en ejemplos de herramientas no son evidencia de enrutado. AX Trust y los proveedores externos conservan la responsabilidad del enrutado y de la autorización aguas arriba.