AgentGuard Burn · Grátis · Local

Veja para onde foram seus tokens do Claude Code.

Um único comando lê o uso que o seu host já salvou e mostra no terminal para onde foram os tokens: fan-out de subagentes, reescritas de cache, histórico reenviado e todo o resto. Grátis em uma máquina. Sem conta, sem chave, sem enviar nada.

npx @agentguard-run/burn why

Lê os metadados de uso que o seu host já salvou. A análise roda localmente. Nenhum dado da sessão é enviado ao AgentGuard. Faz parte do plugin grátis do AgentGuard para Claude Code e Codex.

A gravação mostra o relatório em inglês; o comando why imprime em português quando o seu computador está configurado em português, ou com --lang pt.

Um terminal real rodando o comando em uma sessão real do Claude Code, gravado em 26 de setembro de 2026 com o Burn 0.3.15, sem nada preparado; a tela está ampliada para ficar legível no celular. A sessão: 13,011 respostas do assistente, 4,102,267,088 tokens, $3,489.09 a preço de tabela da API. Só a linha de fan-out de subagentes soma 2,006,841,958 tokens e $1335.37: 48.9% dos tokens da sessão e 38 centavos de cada dólar a preço de tabela. Cada valor em dólares é calculado a preço de tabela da API, não é uma cobrança. O número da pilha de instruções é uma atribuição cumulativa do prefixo fixo: o primeiro contexto medido mais o prefixo em cache correspondente nos turnos seguintes. A linha de base inclui o conteúdo inicial do usuário junto com o prompt do sistema e os esquemas das ferramentas.

A sessão explica a divisão.

A sessão acima é dominada pelo fan-out: quase metade dos tokens foi para subagentes reenviando contexto. Já uma conversa longa pode ser dominada pelo histórico. O Burn se baseia no uso registrado na sessão selecionada, e o que não tem evidência fica em uma linha não atribuída.

Ler a tabela de uso medido do clipe

13,011 respostas do assistente. 4,102,267,088 tokens registrados. $3,489.09 equivalentes a preço de tabela da API. As parcelas de tokens são parcelas do uso, não dos dólares.

CategoriaTokensUSD de tabela% da sessão% do último turno
Pilha de instruções + sistema1,483,887,518$701.0936.2%7.6%
Histórico reenviado546,511,202$334.8213.3%0.0%
Arquivos relidos100,873$1.310.0%0.0%
Fan-out de subagentes2,006,841,958$1335.3748.9%0.0%
Saída de ferramentas3,083,821$50.560.1%0.0%
Conversa2,324,985$34.660.1%0.0%
Reescritas de prefixo completo44,289,700$571.301.1%92.0%
Saída10,173,435$384.750.2%0.4%
Não atribuído5,053,596$75.220.1%0.0%

Os totais de tokens medidos vêm dos deltas de uso. O tamanho em bytes de cada evento registrado só serve para dividir esses totais entre os eventos; bytes nunca são convertidos em tokens. Todo relatório termina com uma seção de método que explica cada categoria.

Entenda o custo de uma sessão longa.

O porquê desta sessão

agentguard-burn why SESSION_ID mostra os tokens, os dólares a preço de tabela da API, a parcela da sessão e a do último turno. Cobre as leituras repetidas de arquivos, as transcrições filhas e o resíduo que não consegue atribuir.

Reescritas de prefixo completo

agentguard-burn rewrites all aponta a causa de cada reescrita (inatividade maior que a vida útil do cache, compactação, o primeiro turno de um subagente, uma troca de modelo, uma atualização de versão, a remoção de imagens ou uma mudança de prefixo) e agentguard-burn ttl calcula quanto um cache de uma hora teria mudado, a partir dos seus próprios intervalos de inatividade.

O ritmo e a próxima hora

agentguard-burn pace SESSION_ID separa os tokens por minuto com e sem cache em uma janela de dez minutos e depois projeta a próxima hora nesse ritmo. Os hooks atualizam o registro local de ritmo a cada evento de ferramenta.

Os minutos até um limite só aparecem quando há porcentagens de uso recentes do host que permitem uma previsão. Se a evidência faltar ou estiver desatualizada, o dado fica como desconhecido.

Um turno pesado, antes do próximo

Antes de um turno com contexto muito grande, o Burn avisa sobre o tempo de processamento e a compactação e sugere começar uma sessão nova com uma nota de passagem. Esses avisos não bloqueiam nenhuma chamada de ferramenta.

Instale em cinco linhas.

npm i -g @agentguard-run/burn
agentguard-burn init claude
agentguard-burn init codex
agentguard-burn statusline
agentguard-burn why

Os comandos init imprimem a configuração para você revisar e não gravam nenhum ajuste. Mescle o trecho do seu host na configuração dele. No Codex, revise o hook e confie nele em /hooks.

Sem um argumento de sessão, o Burn usa uma variável de ambiente de sessão, se houver uma disponível, e, na falta dela, a transcrição local modificada mais recentemente. O argumento de sessão também pode ser o caminho de uma transcrição.

Linha de status do Claude Code

Defina o comando da statusLine como agentguard-burn statusline. O Burn lê o JSON do host pelo stdin e mostra o ritmo, o contexto do último turno, os dólares em reescritas de hoje e uma previsão do limite quando as porcentagens recebidas permitem.

{
  "statusLine": {
    "type": "command",
    "command": "agentguard-burn statusline"
  }
}

Linha complementar no Codex

O Codex 0.154 não tem onde configurar um comando de status externo. Rode agentguard-burn statusline SESSION_ID em um terminal à parte e use os indicadores de limite nativos do host.

Para política de ferramentas, decisões assinadas e o modo Enforce grátis em uma máquina (no Codex e no ChatGPT Work), veja o plugin do AgentGuard.

O que os números significam.

Comece pelo replay se estiver considerando o disjuntor de sessões descontroladas que já existe: npx @agentguard-run/burn replay avalia o seu próprio histórico. O hook independente do Burn começa em modo sombra; o plugin do AgentGuard aplica o disjuntor desde a primeira sessão. A cauda após o STOP do replay é um limite superior, e os contadores legados dele podem diferir do relatório why reconciliado por resposta.

English · Español · Português (Brasil)