

O Paritok compacta as ferramentas, os arquivos e o histórico que seu agente de codificação envia. Economize até 85% na sua conta de tokens e execute sessões 3× mais longas. Dois comandos, nada se perde, totalmente local.
Loading comments…
Criador
blueprint_b
Visitar site
paritok.com
Informações do projeto
Palavras-chave do produto
Alternativas
O Paritok é uma camada de compressão local e auto-hospedada que fica entre seu agente de codificação e seu modelo de linguagem upstream. Ele intercepta os esquemas de ferramentas, leituras de arquivos e histórico de conversa que seu agente envia a cada turno e os reescreve em uma forma compacta antes de chegarem à API. A resposta retorna intacta, e qualquer conteúdo comprimido pode ser expandido sob demanda. O resultado: contas de tokens até 85% menores e sessões que duram aproximadamente 3× mais, tudo com uma única variável de ambiente como integração completa.
Toda a integração é um único export: ANTHROPIC_BASE_URL=http://127.0.0.1:8080. Aponte seu agente para o Paritok e ele lida com a compressão de forma transparente a partir daí. Sem mudanças no SDK, sem instalação de plugins, sem arquivos de configuração para manter.
O Paritok ataca o desperdício de tokens de três ângulos simultaneamente. Primeiro, ele reduz os esquemas de ferramentas de aproximadamente 29K tokens para 8K por turno, mantendo apenas as ferramentas relevantes e criando stubs para o restante. Segundo, ele comprime leituras de arquivos e saídas de ferramentas para cerca de 26% do tamanho original usando um modelo de 4B que preserva identificadores, caminhos e erros. Terceiro, ele resume o histórico de conversa antigo quando seu orçamento de contexto enche, deixando os turnos recentes intactos.
Nada é realmente descartado. Quando o agente precisa dos bytes exatos de um arquivo comprimido ou resultado de ferramenta, ele pode chamar read_original(ref) ou gateway_search_tools(q) para buscá-los localmente — sem gastar um turno extra de API. Isso torna a compressão lossy no envio, mas totalmente recuperável quando importa.
Outras ferramentas que você pode considerar
Como cada leitura de arquivo permanece no histórico e é reenviada a cada turno, a compressão compensa repetidamente. Uma sessão de 1 turno economiza cerca de 25%, mas no turno 20 as economias chegam a 63%, e o teto depende da sua configuração — configurações padrão com ~40 ferramentas podem atingir 72% de economia por turno.
Lossy no envio, recuperável quando importa.
A maioria das ferramentas de compressão força um trade-off permanente entre economia de tokens e fidelidade dos dados. O Paritok contorna isso completamente ao tornar cada peça comprimida recuperável sob demanda, localmente, sem consumir uma chamada de API. Isso significa que você pode reduzir agressivamente o que vai upstream enquanto mantém a capacidade do agente de acessar os bytes exatos da fonte intacta. O efeito composto é o verdadeiro diferencial — quanto mais longa sua sessão, mais você economiza, o que diretamente possibilita as sessões 3× mais longas que usuários intensivos de agentes precisam.
Você está rodando sessões longas de agentes de codificação e vendo os custos de tokens subirem, ou está atingindo os limites da janela de contexto no meio da tarefa. O Paritok é especialmente atraente se você já auto-hospeda suas ferramentas e quer uma solução plug-and-play que não exige modificações no agente. Também vale a pena dar uma olhada se você usa qualquer upstream compatível com OpenAI e quer cortar gastos sem sacrificar a capacidade de recuperar conteúdos exatos de arquivos quando necessário.