

O Compression V2 reduz os custos de tokens de agentes de codificação com três técnicas em duas camadas: corte mais preciso de resultados de ferramentas, nova redução da superfície de ferramentas com consciência de tarefa e brevidade na saída. Integração direta para Claude Code, Codex, OpenCode e Cursor. Semanticamente sem perdas.
Loading comments…
Informações do projeto
Palavras-chave do produto
O Edgee Claude Code Compressor V2 é uma ferramenta de compressão de tokens projetada especificamente para agentes de codificação. Ela reduz o número de tokens enviados para grandes modelos de linguagem durante sessões de codificação, aplicando três técnicas distintas de compressão em duas camadas. O resultado é uma redução de −50% nos tokens em uma sessão típica — caindo de 18.420 para 9.210 tokens — enquanto permanece semanticamente sem perdas em tarefas orientadas a código. Funciona como um wrapper de CLI plug-and-play, sem necessidade de alterações no código, e integra-se com chaves de API e planos existentes.
Esta técnica aprimorada filtra resultados de CLI e ferramentas antes que cheguem ao modelo. Ela remove códigos boilerplate, marcadores de paginação, sequências de escape ANSI, cabeçalhos repetidos e molduras verbosas. Uma listagem de diretório de 980 tokens se torna uma versão densa de 340 tokens que o modelo lê igualmente bem, economizando −10% dos tokens em uma sessão típica.
Novo no V2, esta técnica executa um classificador pequeno e rápido que pontua cada ferramenta em relação à tarefa classificada. Em seguida, remove ou reduz o escopo de ferramentas irrelevantes antes que a solicitação chegue ao modelo. Seu IDE ainda expõe tudo, mas o modelo vê apenas um subconjunto selecionado e relevante para a tarefa — sem mais alternâncias manuais de servidores MCP.
Esta nova técnica reduz a verbosidade das respostas do modelo sem perder conteúdo técnico. Você escolhe o nível (leve, médio, intenso) para equilibrar agressividade com tom. Embora a saída represente apenas ~1% do volume de tokens, é o tráfego pelo qual você mais paga, tornando esta redução de −30% altamente valiosa.
A Compressão V2 reduz pela metade os custos com tokens, mantendo cada bit de contexto que o modelo precisa — semanticamente sem perdas em tarefas de código.
Não se trata apenas de cortar tokens. As três técnicas trabalham juntas nas camadas de entrada e saída, cada uma podendo ser ativada ou desativada independentemente por meio de flags de configuração. A redução da superfície de ferramentas é particularmente inteligente — elimina a necessidade de gerenciar manualmente quais servidores MCP estão ativos, deixando o classificador lidar com a relevância automaticamente. Com sobrecarga de gateway P50 inferior a 12ms e zero alterações no código, o impacto no desempenho é insignificante, enquanto a economia de custos é substancial.
Você usa agentes de codificação como Claude Code, Codex, OpenCode ou Cursor e deseja reduzir os custos com tokens sem alterar seu fluxo de trabalho. É especialmente valioso se você realiza sessões frequentes, onde mesmo pequenas economias por solicitação se acumulam rapidamente, ou se está cansado de alternar manualmente servidores MCP. O wrapper de CLI plug-and-play significa que você pode começar a economizar tokens em minutos, sem alterações no código.
Outras ferramentas que você pode considerar
Execute modelos de código aberto de última geração (GLM 5.1, Kimi K2.7 Code, MiniMax M2.7 e outros) no Claude Code com até 4× a velocidade (até 200 tok/s) por um valor fixo de $29/mês. Configure em minutos, sem alterações no código.
No momento em que um agente precisa implantar algo, ele se depara com um obstáculo feito para humanos. Hoje estamos lançando as Contas Temporárias no Cloudflare Workers. Qualquer agente agora pode executar o comando wrangler deploy --temporary e obter um Worker ativo em segundos.
Mesma IA. 5x mais tokens. O Coworker oferece contexto profundo da empresa e roteia automaticamente para o modelo certo em cada tarefa. Mais chat, colaboração e código com o mesmo gasto.
Você está executando mais agentes de codificação do que nunca, mas não consegue acompanhá-los. É aí que entra o AgentPeek. Ele puxa cada sessão para o notch do seu Mac, ao vivo. Dê uma olhada, aprove um prompt, acompanhe o uso de tokens e gerencie todo o fluxo sem pausar seu vídeo no YouTube. Tudo local, tudo seu.
Criador
sandbyte
Loading comments…