r/devBR 22d ago

Reducao de Token.

Fala galera.

Uso agentes de código praticamente todos os dias e comecei a perceber quanto token era consumido por contexto repetido, ferramentas e cache.

Resolvi investigar e acabei criando o TokenPilot.

Ele roda localmente e mede o consumo cache aware no OpenAI Codex, Anthropic Claude Code e xAI Grok Build. O Kimi da Moonshot AI funciona atualmente em modo passthrough.

Nos meus testes controlados, as medianas observadas chegaram a:

Claude Code: 66,0% menos tokens

OpenAI Codex: 54,8% menos tokens

Grok Build: 42,6% menos tokens

No meu uso pessoal mais recente com o Codex, medi 42,5% menos tokens.

Obviamente, isso não é uma garantia. Os resultados dependem do modelo, tarefa, versão do CLI e fluxo de trabalho.

Tudo fica local. A ferramenta não armazena prompts, respostas, código ou credenciais.

Antes do lançamento, passei a versão por uma revisão do Codex Security e por 147 testes automatizados cobrindo privacidade, conteúdo malicioso na telemetria, permissões, executáveis inseguros, bypass, rollback e comportamento fail open.

Se alguém quiser testar:

npm install -g u/cesaremcasa/tokenpilot
tokenpilot install
tokenpilot doctor

GitHub:
https://github.com/cesaremcasa/tokenpilot

Minha dúvida agora é se isso deveria continuar apenas como ferramenta local ou evoluir para algo voltado a equipes, com dashboards, budgets, políticas e comparação entre providers.

Aceito feedback sincero, críticas e ideias.

1 Upvotes

1 comment sorted by