Un solo comando lee el uso que tu host ya guardó y muestra en la terminal a dónde se fueron los tokens: fan-out de subagentes, reescrituras de caché, historial reenviado y todo lo demás. Gratis en una máquina. Sin cuenta, sin clave, sin subir nada.
npx @agentguard-run/burn why
Lee los metadatos de uso que tu host ya guardó. El análisis se ejecuta localmente. Ningún dato de la sesión se envía a AgentGuard. Forma parte del plugin gratis de AgentGuard para Claude Code y Codex.
La grabación muestra el informe en inglés; el comando why lo imprime en español cuando tu computadora está configurada en español, o con --lang es.
Una terminal real que ejecuta el comando sobre una sesión real de Claude Code, grabada el 26 de septiembre de 2026 con Burn 0.3.15, sin nada preparado; la vista está ampliada para que se pueda leer en el celular. La sesión: 13,011 respuestas del asistente, 4,102,267,088 tokens, $3,489.09 a precio de lista de la API. Solo la fila de fan-out de subagentes suma 2,006,841,958 tokens y $1335.37: el 48.9% de los tokens de la sesión y 38 centavos de cada dólar a precio de lista. Cada monto en dólares se calcula a precio de lista de la API, no es una factura. La cifra de la pila de instrucciones es una atribución acumulativa del prefijo fijo: el primer contexto medido más el prefijo en caché que coincide en los turnos siguientes. La línea base incluye el contenido inicial del usuario junto con el prompt del sistema y los esquemas de las herramientas.
La sesión explica el reparto.
La sesión de arriba está dominada por el fan-out: casi la mitad de sus tokens se fue en subagentes que reenviaban contexto. Una conversación larga, en cambio, puede estar dominada por el historial. Burn se basa en el uso registrado en la sesión seleccionada, y lo que no tiene evidencia queda en una fila sin atribuir.
Leer la tabla de uso medido del clip
13,011 respuestas del asistente. 4,102,267,088 tokens registrados. $3,489.09 equivalentes a precio de lista de la API. Las proporciones de tokens son proporciones del uso, no de los dólares.
Categoría
Tokens
USD de lista
% de la sesión
% del último turno
Pila de instrucciones + sistema
1,483,887,518
$701.09
36.2%
7.6%
Historial reenviado
546,511,202
$334.82
13.3%
0.0%
Archivos releídos
100,873
$1.31
0.0%
0.0%
Fan-out de subagentes
2,006,841,958
$1335.37
48.9%
0.0%
Salida de herramientas
3,083,821
$50.56
0.1%
0.0%
Conversación
2,324,985
$34.66
0.1%
0.0%
Reescrituras de prefijo completo
44,289,700
$571.30
1.1%
92.0%
Salida
10,173,435
$384.75
0.2%
0.4%
Sin atribuir
5,053,596
$75.22
0.1%
0.0%
Los totales de tokens medidos salen de los deltas de uso. El tamaño en bytes de cada evento registrado solo sirve para repartir esos totales entre los eventos; los bytes nunca se convierten en tokens. Cada informe termina con una sección de método que explica cada categoría.
Entiende el costo de una sesión larga.
El porqué de esta sesión
agentguard-burn why SESSION_ID muestra los tokens, los dólares a precio de lista de la API, la proporción de la sesión y la del último turno. Cubre las lecturas repetidas de archivos, las transcripciones hijas y el residuo que no puede atribuir.
Reescrituras de prefijo completo
agentguard-burn rewrites all indica la causa de cada reescritura (inactividad más larga que la vida útil de la caché, compactación, el primer turno de un subagente, un cambio de modelo, una actualización de versión, la eliminación de imágenes o un cambio de prefijo) y agentguard-burn ttl calcula cuánto habría cambiado una caché de una hora, a partir de tus propios tiempos de inactividad.
El ritmo y la próxima hora
agentguard-burn pace SESSION_ID separa los tokens por minuto con y sin caché en una ventana de diez minutos y luego proyecta la próxima hora a ese ritmo. Los hooks actualizan el registro local de ritmo con cada evento de herramienta.
Los minutos hasta un límite solo aparecen cuando hay porcentajes de uso recientes del host que permiten un pronóstico. Si la evidencia falta o está desactualizada, el dato queda como desconocido.
Un turno pesado, antes del siguiente
Antes de un turno con un contexto muy grande, Burn avisa sobre el tiempo de procesamiento y la compactación, y sugiere empezar una sesión nueva con una nota de traspaso. Estos avisos no bloquean ninguna llamada a herramientas.
Instálalo en cinco líneas.
npm i -g @agentguard-run/burn
agentguard-burn init claude
agentguard-burn init codex
agentguard-burn statusline
agentguard-burn why
Los comandos init imprimen la configuración para que la revises y no escriben ningún ajuste. Combina el fragmento de tu host con su configuración. En Codex, revisa el hook y confía en él desde /hooks.
Sin un argumento de sesión, Burn usa una variable de entorno de sesión si hay una disponible y, si no, la transcripción local modificada más recientemente. El argumento de sesión también puede ser la ruta de una transcripción.
Línea de estado de Claude Code
Configura el comando de statusLine como agentguard-burn statusline. Burn lee el JSON del host por stdin y muestra el ritmo, el contexto del último turno, los dólares en reescrituras de hoy y un pronóstico del límite cuando los porcentajes recibidos lo permiten.
Codex 0.154 no tiene dónde configurar un comando de estado externo. Ejecuta agentguard-burn statusline SESSION_ID en una terminal aparte y usa los indicadores de límite nativos del host.
Para la política de herramientas, las decisiones firmadas y el modo Enforce gratis en una máquina (en Codex y ChatGPT Work), consulta el plugin de AgentGuard.
Qué significan los números.
Burn no puede ver la cuota real de tu suscripción. Un pronóstico se basa en muestras explícitas de porcentaje del host, cuando las hay; no inventa un cupo de tokens ni una ponderación de las lecturas de caché.
Las columnas en dólares usan la tarifa de lista de la API del modelo registrado. No son la factura de tu suscripción. Ejecuta agentguard-burn pricing para ver la fuente y la fecha de cada tarifa; los modelos desconocidos solo muestran tokens. Una configuración local de precios puede sustituirlas por tus tarifas verificadas.
Una sola máquina. Otros dispositivos no comparten este estado local.
No se guardan ni se muestran prompts, respuestas ni contenidos de archivos. Sin telemetría.
Empieza con replay si estás considerando el cortacircuito de sesiones desbocadas que ya existe: npx @agentguard-run/burn replay evalúa tu propio historial. El hook independiente de Burn arranca en modo sombra; el plugin de AgentGuard aplica el cortacircuito desde su primera sesión. La cola posterior al STOP de replay es una cota superior, y sus contadores heredados pueden diferir del informe why reconciliado por respuesta.