
Paritok comprime las herramientas, los archivos y el historial que envía tu agente de codificación. Ahorra hasta un 85% en tu factura de tokens y ejecuta sesiones 3× más largas. Dos comandos, nada se pierde, totalmente local.
Loading comments…
Información del proyecto
Palabras clave del producto
Paritok es una capa de compresión local y autoalojada que se sitúa entre tu agente de codificación y su modelo de lenguaje upstream. Intercepta los esquemas de herramientas, las lecturas de archivos y el historial de conversación que tu agente envía en cada turno, y los reescribe en una forma compacta antes de que lleguen a la API. La respuesta regresa sin cambios, y cualquier contenido comprimido puede expandirse bajo demanda. El resultado: facturas de tokens hasta un 85% más bajas y sesiones que duran aproximadamente 3 veces más, todo con una única variable de entorno como integración completa.
Toda la integración es una sola exportación: ANTHROPIC_BASE_URL=http://127.0.0.1:8080. Apunta tu agente a Paritok y este maneja la compresión de forma transparente desde ahí. Sin cambios en el SDK, sin instalaciones de plugins, sin archivos de configuración que mantener.
Paritok ataca el desperdicio de tokens desde tres ángulos simultáneamente. Primero, recorta los esquemas de herramientas de aproximadamente 29K tokens a 8K por turno, manteniendo solo las herramientas relevantes y dejando el resto como stubs. Segundo, comprime las lecturas de archivos y la salida de herramientas a aproximadamente el 26% de su tamaño original usando un modelo de 4B que preserva identificadores, rutas y errores. Tercero, resume el historial de conversación obsoleto una vez que tu presupuesto de contexto se llena, dejando los turnos recientes intactos.
Nada se descarta realmente. Cuando el agente necesita los bytes exactos de un archivo comprimido o un resultado de herramienta, puede llamar a read_original(ref) o gateway_search_tools(q) para obtenerlos localmente, sin gastar un turno extra de API. Esto hace que la compresión sea con pérdida en la transmisión, pero totalmente recuperable cuando importa.
Como cada lectura de archivo permanece en el historial y se reenvía en cada turno, la compresión se paga repetidamente. Una sesión de 1 turno ahorra aproximadamente un 25%, pero para el turno 20 los ahorros alcanzan el 63%, y el techo depende de tu configuración: las configuraciones predeterminadas con ~40 herramientas pueden alcanzar un 72% de ahorro por turno.
Con pérdida en la transmisión, recuperable cuando importa.
La mayoría de las herramientas de compresión fuerzan un trade-off permanente entre ahorro de tokens y fidelidad de datos. Paritok evita esto por completo haciendo que cada pieza comprimida sea recuperable bajo demanda, localmente, sin consumir una llamada de API. Esto significa que puedes reducir agresivamente lo que se envía upstream mientras mantienes la capacidad del agente para acceder a los bytes exactos de la fuente. El efecto acumulativo es el verdadero diferenciador: cuanto más larga es tu sesión, más ahorras, lo que directamente permite las sesiones 3 veces más largas que los usuarios intensivos de agentes necesitan.
Estás ejecutando sesiones largas de agentes de codificación y viendo cómo los costos de tokens suben, o estás alcanzando los límites de la ventana de contexto a mitad de tarea. Paritok es especialmente atractivo si ya autoalojas tus herramientas y quieres una solución plug-and-play que no requiera modificaciones en el agente. También vale la pena considerarlo si usas cualquier upstream compatible con OpenAI y quieres reducir gastos sin sacrificar la capacidad de recuperar contenidos exactos de archivos cuando sea necesario.
Creador
blueprint_b
Alternativas
Otras herramientas que podrías considerar
En el momento en que un agente necesita desplegar algo, se topa de frente con un muro diseñado para humanos. Hoy lanzamos las Cuentas Temporales en Cloudflare Workers. Cualquier agente puede ejecutar ahora wrangler deploy —temporal— y obtener un Worker en vivo en cuestión de segundos.
GitHits permite a los agentes de codificación acceder al código de código abierto del que depende tu aplicación. Obtén ejemplos de implementación reales, navegación por el código fuente de las dependencias, inspección de paquetes y documentación. Los agentes pueden buscar y leer tu base de código. Pero no pueden buscar ni leer el código de código abierto del que depende tu aplicación. Ahí es donde empiezan a adivinar, reintentar y entrar en bucles. GitHits crea un índice consciente de la versión bajo demanda. Los agentes pueden buscar, navegar e inspeccionar el código detrás de sus dependencias. CLI: npx githits@latest init
El mismo AI. 5 veces más tokens. Coworker proporciona contexto profundo de la empresa y enruta automáticamente al modelo adecuado para cada tarea. Más chat, cowork y código con el mismo gasto.
Octopoda es una capa de infraestructura de código abierto que otorga a los agentes de IA memoria persistente, detección automática de bucles y observabilidad completa. Los agentes olvidan todo entre sesiones. Octopoda soluciona esto con una API de recordar/recuperar que sobrevive a reinicios, fallos y despliegues. El sistema de detección de bucles monitorea 5 señales para detectar agentes atrapados repitiéndose antes de que consuman tu presupuesto de API, con una estimación de costos en tiempo real que muestra exactamente cuánto desperdicia cada bucle. Un panel integrado muestra la puntuación de salud de cada agente, un explorador de memoria con historial de versiones, un registro de auditoría que documenta cada decisión con su razonamiento, y una reproducción de línea de tiempo que te permite revisar paso a paso todo lo que hizo tu agente. Funciona con LangChain, CrewAI, AutoGen y OpenAI Agents SDK con integraciones de una sola línea. Se ejecuta localmente con SQLite o se conecta a la nube con una variable de entorno. Nivel gratuito, licencia MIT. 177 registros, 120 estrellas en GitHub, cero gasto en marketing.
Loading comments…