Eu rastrei 430 horas de uso do Claude Code. 73% foi desperdiçado nesses 9 padrões.
Conteudo
TLDR;
Os 9 padrões são fatores como o CLAUDE.md inchado, re‑leitura do histórico de conversa, injeção de hooks, carregamento de skills e ferramentas desnecessárias, cache miss, pensamento estendido, geração na direção errada e atualizações automáticas de plugins, que juntos consomem 73% dos tokens. Para cortar esse desperdício basta aplicar as correções rápidas descritas – reduzir o tamanho do CLAUDE.md, limitar o número de mensagens, desativar hooks e skills irrelevantes, usar cache de 1 hora, desligar o pensamento avançado e interromper gerações erradas, entre outras ajustes de 30 segundos. Com essas mudanças o uso produtivo subiu de 27% para cerca de 65% dos tokens, economizando milhares de tokens e cerca de US$ 200‑300 por mês, dependendo do volume de trabalho.
Tweet
Em 90 dias, o autor registrou 430 horas de uso do Claude Code – 6 milhões de tokens de entrada e US$ 1.340 em custos de API – e descobriu que 73 % dos tokens eram desperdiçados em nove padrões invisíveis que ocorriam de forma automática. O maior vilão foi o CLAUDE.md inflado (≈ 14 % dos tokens), que carregava 4 800 tokens a cada turno; ao reduzir para 900 tokens o custo basal caiu 31 %. Em seguida, a releitura do histórico de conversa (≈ 13 %) fazia cada nova mensagem re‑tokenizar todo o diálogo, levando a um gasto 60× maior em chats longos; limitar a 20 mensagens ou editar mensagens antigas cortou 40 % desse custo. Hooks de plugins (≈ 11 %) injetavam 6 200 tokens por prompt; eliminar os hooks desnecessários economizou 5 800 tokens por chamada. Cache miss ao retomar sessões (≈ 10 %) cobria o conteúdo inteiro quando o intervalo superava 5 min; estender o cache para 1 h reduziu o gasto em 80 %. Carregamento automático de skills (≈ 7 %) e definições de ferramentas “por precaução” (≈ 6 %) introduziam milhares de tokens inúteis; auditoria e desativação de itens raramente usados salvaram 9 000 tokens por tarefa e 6 000 tokens por requisição, respectivamente. Pensamento avançado ativado indiscriminadamente (≈ 5 %) e geração na direção errada (≈ 4 %) desperdiçavam output que poderia ser interrompido imediatamente, gerando economia de cerca de $15 mensais. Por fim, auto‑updates de plugins (≈ 3 %) consumiam 1 200 tokens a cada início de sessão. Aplicando correções de 30 segundos para cada padrão, o autor elevou a parcela produtiva de 27 % para ≈ 65 % dos tokens, mostrando que o gargalo não são prompts ou modelos, mas o custo de sobrecarga constante. Auditar regularmente, reduzir o CLAUDE.md, limitar histórico, desativar hooks/skills desnecessários, otimizar cache e desligar pensamento avançado quando não preciso transformam limites de uso em recurso efetivo.
-
Post original: Eu rastrei 430 horas de uso do Claude Code. 73% foi desperdiçado nesses 9 padrões.