

Paritok comprime las herramientas, los archivos y el historial que envía tu agente de codificación. Ahorra hasta un 85% en tu factura de tokens y ejecuta sesiones 3× más largas. Dos comandos, nada se pierde, totalmente local.
Loading comments…
Creador
blueprint_b
Visitar sitio web
paritok.com
Información del proyecto
Palabras clave del producto
Alternativas
Paritok es una capa de compresión local y autoalojada que se sitúa entre tu agente de codificación y su modelo de lenguaje upstream. Intercepta los esquemas de herramientas, las lecturas de archivos y el historial de conversación que tu agente envía en cada turno, y los reescribe en una forma compacta antes de que lleguen a la API. La respuesta regresa sin cambios, y cualquier contenido comprimido puede expandirse bajo demanda. El resultado: facturas de tokens hasta un 85% más bajas y sesiones que duran aproximadamente 3 veces más, todo con una única variable de entorno como integración completa.
Toda la integración es una sola exportación: ANTHROPIC_BASE_URL=http://127.0.0.1:8080. Apunta tu agente a Paritok y este maneja la compresión de forma transparente desde ahí. Sin cambios en el SDK, sin instalaciones de plugins, sin archivos de configuración que mantener.
Paritok ataca el desperdicio de tokens desde tres ángulos simultáneamente. Primero, recorta los esquemas de herramientas de aproximadamente 29K tokens a 8K por turno, manteniendo solo las herramientas relevantes y dejando el resto como stubs. Segundo, comprime las lecturas de archivos y la salida de herramientas a aproximadamente el 26% de su tamaño original usando un modelo de 4B que preserva identificadores, rutas y errores. Tercero, resume el historial de conversación obsoleto una vez que tu presupuesto de contexto se llena, dejando los turnos recientes intactos.
Nada se descarta realmente. Cuando el agente necesita los bytes exactos de un archivo comprimido o un resultado de herramienta, puede llamar a o para obtenerlos localmente, sin gastar un turno extra de API. Esto hace que la compresión sea con pérdida en la transmisión, pero totalmente recuperable cuando importa.
Otras herramientas que podrías considerar
read_original(ref)gateway_search_tools(q)Como cada lectura de archivo permanece en el historial y se reenvía en cada turno, la compresión se paga repetidamente. Una sesión de 1 turno ahorra aproximadamente un 25%, pero para el turno 20 los ahorros alcanzan el 63%, y el techo depende de tu configuración: las configuraciones predeterminadas con ~40 herramientas pueden alcanzar un 72% de ahorro por turno.
Con pérdida en la transmisión, recuperable cuando importa.
La mayoría de las herramientas de compresión fuerzan un trade-off permanente entre ahorro de tokens y fidelidad de datos. Paritok evita esto por completo haciendo que cada pieza comprimida sea recuperable bajo demanda, localmente, sin consumir una llamada de API. Esto significa que puedes reducir agresivamente lo que se envía upstream mientras mantienes la capacidad del agente para acceder a los bytes exactos de la fuente. El efecto acumulativo es el verdadero diferenciador: cuanto más larga es tu sesión, más ahorras, lo que directamente permite las sesiones 3 veces más largas que los usuarios intensivos de agentes necesitan.
Estás ejecutando sesiones largas de agentes de codificación y viendo cómo los costos de tokens suben, o estás alcanzando los límites de la ventana de contexto a mitad de tarea. Paritok es especialmente atractivo si ya autoalojas tus herramientas y quieres una solución plug-and-play que no requiera modificaciones en el agente. También vale la pena considerarlo si usas cualquier upstream compatible con OpenAI y quieres reducir gastos sin sacrificar la capacidad de recuperar contenidos exactos de archivos cuando sea necesario.