
Paritok compresse les outils, fichiers et l'historique que votre agent de codage envoie. Économisez jusqu'à 85 % sur votre facture de tokens et profitez de sessions 3× plus longues. Deux commandes, aucune perte, entièrement local.
Loading comments…
Infos du projet
Mots-clés du produit
Paritok est une couche de compression locale et auto-hébergée qui s'intercale entre votre agent de codage et son modèle de langage en amont. Elle intercepte les schémas d'outils, les lectures de fichiers et l'historique de conversation que votre agent envoie à chaque tour, puis les réécrit sous une forme compacte avant qu'ils n'atteignent l'API. La réponse revient intacte, et tout contenu compressé peut être développé à la demande. Le résultat : jusqu'à 85 % de réduction sur vos factures de tokens et des sessions environ 3× plus longues, le tout avec une seule variable d'environnement comme intégration complète.
Toute l'intégration se résume à une seule exportation : ANTHROPIC_BASE_URL=http://127.0.0.1:8080. Pointez votre agent vers Paritok, et il gère la compression de manière transparente à partir de là. Aucun changement de SDK, aucune installation de plugin, aucun fichier de configuration à maintenir.
Paritok attaque le gaspillage de tokens sous trois angles simultanément. Premièrement, il réduit les schémas d'outils d'environ 29K tokens à 8K par tour en ne conservant que les outils pertinents et en masquant les autres. Deuxièmement, il compresse les lectures de fichiers et les sorties d'outils à environ 26 % de leur taille d'origine grâce à un modèle 4B qui préserve les identifiants, les chemins et les erreurs. Troisièmement, il résume l'historique de conversation obsolète une fois que votre budget de contexte est épuisé, laissant les tours récents intacts.
Rien n'est jamais réellement jeté. Lorsque l'agent a besoin des octets exacts d'un fichier compressé ou d'un résultat d'outil, il peut appeler read_original(ref) ou gateway_search_tools(q) pour les récupérer localement — sans brûler un tour d'API supplémentaire. Cela rend la compression avec pertes sur le fil, mais entièrement récupérable quand cela compte.
Comme chaque lecture de fichier reste dans l'historique et est renvoyée à chaque tour, la compression est rentabilisée à plusieurs reprises. Une session d'un tour économise environ 25 %, mais au tour 20, les économies atteignent 63 %, et le plafond dépend de votre configuration — les configurations par défaut avec environ 40 outils peuvent atteindre 72 % d'économies par tour.
Avec pertes sur le fil, récupérable quand cela compte.
La plupart des outils de compression imposent un compromis permanent entre économies de tokens et fidélité des données. Paritok contourne cela entièrement en rendant chaque élément compressé récupérable à la demande, localement, sans consommer un appel API. Cela signifie que vous pouvez réduire agressivement ce qui part en amont tout en préservant la capacité de l'agent à accéder aux octets sources exacts. L'effet cumulatif est le véritable différenciateur — plus votre session dure, plus vous économisez, ce qui permet directement les sessions 3× plus longues dont les utilisateurs intensifs d'agents ont besoin.
Vous exécutez de longues sessions d'agents de codage et voyez les coûts de tokens grimper, ou vous atteignez les limites de la fenêtre de contexte en plein milieu d'une tâche. Paritok est particulièrement intéressant si vous auto-hébergez déjà vos outils et souhaitez une solution clé en main qui ne nécessite aucune modification de l'agent. Cela vaut aussi le coup d'œil si vous utilisez un fournisseur compatible OpenAI et souhaitez réduire vos dépenses sans sacrifier la possibilité de récupérer le contenu exact des fichiers quand nécessaire.
D'autres outils que vous pourriez envisager
Le moment où un agent doit déployer quelque chose, il se heurte de plein fouet à un mur conçu pour les humains. Aujourd'hui, nous déployons les comptes temporaires sur Cloudflare Workers. N'importe quel agent peut désormais exécuter wrangler deploy — temporary et obtenir un Worker en ligne en quelques secondes.
GitHits permet aux agents de codage d'accéder au code open source dont votre application dépend. Obtenez des exemples d'implémentation concrets, une navigation dans les sources des dépendances, une inspection des packages et de la documentation. Les agents peuvent parcourir et lire votre codebase. Mais ils ne peuvent pas parcourir et lire le code open source dont votre application dépend. C'est là qu'ils commencent à deviner, à réessayer et à boucler. GitHits construit un index tenant compte des versions à la demande. Les agents peuvent rechercher, naviguer et inspecter le code derrière leurs dépendances. CLI : npx githits@latest init
Même IA. 5 fois plus de tokens. Coworker fournit un contexte approfondi sur l'entreprise et achemine automatiquement vers le bon modèle pour chaque tâche. Plus de chat, de collaboration et de code avec le même budget.
Octopoda est une couche d'infrastructure open source qui offre aux agents IA une mémoire persistante, une détection automatique des boucles et une observabilité complète. Les agents oublient tout entre les sessions. Octopoda résout ce problème avec une API de mémorisation/rappel qui survit aux redémarrages, aux plantages et aux déploiements. Le système de détection de boucles surveille 5 signaux pour repérer les agents qui se répètent avant qu'ils ne brûlent votre budget API, avec une estimation des coûts en temps réel montrant exactement combien chaque boucle gaspille. Un tableau de bord intégré affiche le score de santé de chaque agent, un explorateur de mémoire avec historique des versions, une piste d'audit enregistrant chaque décision avec son raisonnement, et une relecture chronologique qui vous permet de parcourir pas à pas tout ce que votre agent a fait. Fonctionne avec LangChain, CrewAI, AutoGen et OpenAI Agents SDK grâce à des intégrations en une seule ligne. S'exécute localement avec SQLite ou se connecte au cloud avec une seule variable d'environnement. Niveau gratuit, licence MIT. 177 inscriptions, 120 étoiles GitHub, zéro dépense marketing.
Créateur
blueprint_b
Alternatives
Loading comments…