Um único comando lê o uso que o seu host já salvou e mostra no terminal para onde foram os tokens: fan-out de subagentes, reescritas de cache, histórico reenviado e todo o resto. Grátis em uma máquina. Sem conta, sem chave, sem enviar nada.
npx @agentguard-run/burn why
Lê os metadados de uso que o seu host já salvou. A análise roda localmente. Nenhum dado da sessão é enviado ao AgentGuard. Faz parte do plugin grátis do AgentGuard para Claude Code e Codex.
A gravação mostra o relatório em inglês; o comando why imprime em português quando o seu computador está configurado em português, ou com --lang pt.
Um terminal real rodando o comando em uma sessão real do Claude Code, gravado em 26 de setembro de 2026 com o Burn 0.3.15, sem nada preparado; a tela está ampliada para ficar legível no celular. A sessão: 13,011 respostas do assistente, 4,102,267,088 tokens, $3,489.09 a preço de tabela da API. Só a linha de fan-out de subagentes soma 2,006,841,958 tokens e $1335.37: 48.9% dos tokens da sessão e 38 centavos de cada dólar a preço de tabela. Cada valor em dólares é calculado a preço de tabela da API, não é uma cobrança. O número da pilha de instruções é uma atribuição cumulativa do prefixo fixo: o primeiro contexto medido mais o prefixo em cache correspondente nos turnos seguintes. A linha de base inclui o conteúdo inicial do usuário junto com o prompt do sistema e os esquemas das ferramentas.
A sessão explica a divisão.
A sessão acima é dominada pelo fan-out: quase metade dos tokens foi para subagentes reenviando contexto. Já uma conversa longa pode ser dominada pelo histórico. O Burn se baseia no uso registrado na sessão selecionada, e o que não tem evidência fica em uma linha não atribuída.
Ler a tabela de uso medido do clipe
13,011 respostas do assistente. 4,102,267,088 tokens registrados. $3,489.09 equivalentes a preço de tabela da API. As parcelas de tokens são parcelas do uso, não dos dólares.
Categoria
Tokens
USD de tabela
% da sessão
% do último turno
Pilha de instruções + sistema
1,483,887,518
$701.09
36.2%
7.6%
Histórico reenviado
546,511,202
$334.82
13.3%
0.0%
Arquivos relidos
100,873
$1.31
0.0%
0.0%
Fan-out de subagentes
2,006,841,958
$1335.37
48.9%
0.0%
Saída de ferramentas
3,083,821
$50.56
0.1%
0.0%
Conversa
2,324,985
$34.66
0.1%
0.0%
Reescritas de prefixo completo
44,289,700
$571.30
1.1%
92.0%
Saída
10,173,435
$384.75
0.2%
0.4%
Não atribuído
5,053,596
$75.22
0.1%
0.0%
Os totais de tokens medidos vêm dos deltas de uso. O tamanho em bytes de cada evento registrado só serve para dividir esses totais entre os eventos; bytes nunca são convertidos em tokens. Todo relatório termina com uma seção de método que explica cada categoria.
Entenda o custo de uma sessão longa.
O porquê desta sessão
agentguard-burn why SESSION_ID mostra os tokens, os dólares a preço de tabela da API, a parcela da sessão e a do último turno. Cobre as leituras repetidas de arquivos, as transcrições filhas e o resíduo que não consegue atribuir.
Reescritas de prefixo completo
agentguard-burn rewrites all aponta a causa de cada reescrita (inatividade maior que a vida útil do cache, compactação, o primeiro turno de um subagente, uma troca de modelo, uma atualização de versão, a remoção de imagens ou uma mudança de prefixo) e agentguard-burn ttl calcula quanto um cache de uma hora teria mudado, a partir dos seus próprios intervalos de inatividade.
O ritmo e a próxima hora
agentguard-burn pace SESSION_ID separa os tokens por minuto com e sem cache em uma janela de dez minutos e depois projeta a próxima hora nesse ritmo. Os hooks atualizam o registro local de ritmo a cada evento de ferramenta.
Os minutos até um limite só aparecem quando há porcentagens de uso recentes do host que permitem uma previsão. Se a evidência faltar ou estiver desatualizada, o dado fica como desconhecido.
Um turno pesado, antes do próximo
Antes de um turno com contexto muito grande, o Burn avisa sobre o tempo de processamento e a compactação e sugere começar uma sessão nova com uma nota de passagem. Esses avisos não bloqueiam nenhuma chamada de ferramenta.
Instale em cinco linhas.
npm i -g @agentguard-run/burn
agentguard-burn init claude
agentguard-burn init codex
agentguard-burn statusline
agentguard-burn why
Os comandos init imprimem a configuração para você revisar e não gravam nenhum ajuste. Mescle o trecho do seu host na configuração dele. No Codex, revise o hook e confie nele em /hooks.
Sem um argumento de sessão, o Burn usa uma variável de ambiente de sessão, se houver uma disponível, e, na falta dela, a transcrição local modificada mais recentemente. O argumento de sessão também pode ser o caminho de uma transcrição.
Linha de status do Claude Code
Defina o comando da statusLine como agentguard-burn statusline. O Burn lê o JSON do host pelo stdin e mostra o ritmo, o contexto do último turno, os dólares em reescritas de hoje e uma previsão do limite quando as porcentagens recebidas permitem.
O Codex 0.154 não tem onde configurar um comando de status externo. Rode agentguard-burn statusline SESSION_ID em um terminal à parte e use os indicadores de limite nativos do host.
Para política de ferramentas, decisões assinadas e o modo Enforce grátis em uma máquina (no Codex e no ChatGPT Work), veja o plugin do AgentGuard.
O que os números significam.
O Burn não consegue ver a cota real da sua assinatura. Uma previsão segue amostras explícitas de porcentagem do host, quando existem; ele não inventa uma franquia de tokens nem uma ponderação das leituras de cache.
As colunas em dólares usam a tarifa de tabela da API do modelo registrado. Elas não são a fatura da sua assinatura. Rode agentguard-burn pricing para ver a fonte e a data de cada tarifa; modelos desconhecidos mostram só tokens. Uma configuração local de preços pode substituí-las pelas suas tarifas verificadas.
Uma única máquina. Outros dispositivos não compartilham este estado local.
Nenhum prompt, resposta ou conteúdo de arquivo é armazenado ou exibido. Sem telemetria.
Comece pelo replay se estiver considerando o disjuntor de sessões descontroladas que já existe: npx @agentguard-run/burn replay avalia o seu próprio histórico. O hook independente do Burn começa em modo sombra; o plugin do AgentGuard aplica o disjuntor desde a primeira sessão. A cauda após o STOP do replay é um limite superior, e os contadores legados dele podem diferir do relatório why reconciliado por resposta.