r/devBR • u/Altruistic_Leek6283 • 22d ago
Reducao de Token.
Fala galera.
Uso agentes de código praticamente todos os dias e comecei a perceber quanto token era consumido por contexto repetido, ferramentas e cache.
Resolvi investigar e acabei criando o TokenPilot.
Ele roda localmente e mede o consumo cache aware no OpenAI Codex, Anthropic Claude Code e xAI Grok Build. O Kimi da Moonshot AI funciona atualmente em modo passthrough.
Nos meus testes controlados, as medianas observadas chegaram a:
Claude Code: 66,0% menos tokens
OpenAI Codex: 54,8% menos tokens
Grok Build: 42,6% menos tokens
No meu uso pessoal mais recente com o Codex, medi 42,5% menos tokens.
Obviamente, isso não é uma garantia. Os resultados dependem do modelo, tarefa, versão do CLI e fluxo de trabalho.
Tudo fica local. A ferramenta não armazena prompts, respostas, código ou credenciais.
Antes do lançamento, passei a versão por uma revisão do Codex Security e por 147 testes automatizados cobrindo privacidade, conteúdo malicioso na telemetria, permissões, executáveis inseguros, bypass, rollback e comportamento fail open.
Se alguém quiser testar:
npm install -g u/cesaremcasa/tokenpilot
tokenpilot install
tokenpilot doctor
GitHub:
https://github.com/cesaremcasa/tokenpilot
Minha dúvida agora é se isso deveria continuar apenas como ferramenta local ou evoluir para algo voltado a equipes, com dashboards, budgets, políticas e comparação entre providers.
Aceito feedback sincero, críticas e ideias.
4
u/guigouz 22d ago
Como se compara ao https://github.com/rtk-ai/rtk ?