
Vous pouvez désormais offrir une mémoire infinie à Hermes, Claude Code et Codex. Agentmemory est en tendance sur GitHub avec plus de 5 000 étoiles. CLAUDE md injecte 22 000+ tokens dans le contexte à raison de 240 observations agentmemory : 1 900 tokens. mêmes observations. 92 % de moins. À 1 000 observations, 80 % de vos mémoires intégrées deviennent invisibles. agentmemory conserve 100 % de recherche possible. testé sur 240 sessions de codage réelles → Jusqu'à 95 % de tokens en moins par session → 200 fois plus d'appels d'outils avant d'atteindre les limites de contexte → 100 % open source
Loading comments…
Infos du projet
Mots-clés du produit
Agentmemory est un runtime mémoire complet conçu spécifiquement pour les agents de codage comme Hermes, Claude Code et Codex. Au lieu de traiter la mémoire comme une simple fonctionnalité secondaire avec des magasins vectoriels ou des bases de données externes, Agentmemory offre aux agents une mémoire infinie et consultable qui fonctionne immédiatement. Il capture chaque appel d'outil, invite et arrêt de session sous forme d'observations compressées, puis les rend consultables en quelques millisecondes, le tout à partir d'un seul processus Node sans aucune dépendance externe.
Agentmemory ne repose pas sur une seule méthode de récupération. Il combine la recherche lexicale BM25, la similarité vectorielle et le parcours de graphes de connaissances, puis réordonne les résultats sur l'appareil. Le résultat est un taux de R@5 de 95,2 % sur LongMemEval-S avec une latence P50 inférieure à 20 millisecondes sur un ordinateur portable.
Douze crochets intégrés acheminent chaque événement PreToolUse, PostToolUse, SessionStart et Stop directement dans le pipeline mémoire. Aucun code de liaison, aucune instrumentation manuelle : installez le plugin et chaque action de l'agent devient automatiquement une observation compressée.
Des balayages horaires compressent les observations brutes en souvenirs sémantiques, fusionnent les doublons et suppriment les lignes obsolètes avec un score de rétention. Chaque suppression émet une ligne d'audit groupée, vous savez donc toujours ce qui a été supprimé et pourquoi. Cela maintient la mémoire légère sans perdre de signal.
Agentmemory expose un serveur MCP complet avec des outils comme memory_save, memory_recall, memory_smart_search et memory_sessions. Chaque outil MCP possède également un jumeau REST sous /agentmemory/*, vous pouvez donc l'utiliser avec curl, le récupérer depuis un navigateur ou le proxyer depuis votre propre agent.
"Avec 1 000 observations, 80 % de vos souvenirs intégrés deviennent invisibles. Agentmemory en garde 100 % consultables."
C'est l'idée centrale derrière la conception d'Agentmemory. Les approches mémoire standard perdent en visibilité à mesure que le contexte s'agrandit : les observations sont enterrées ou abandonnées. Le rappel à triple flux d'Agentmemory et la consolidation horaire garantissent que chaque observation reste consultable, quel que soit le volume. Dans les sessions de codage évaluées, cela se traduit par jusqu'à 95 % de tokens en moins par session et 200 fois plus d'appels d'outils avant d'atteindre les limites de contexte.
Vous en avez assez que votre agent de codage oublie ce qu'il a fait il y a deux sessions, ou vous en avez assez de configurer Redis, Kafka et un magasin vectoriel juste pour donner une mémoire persistante à un agent. Agentmemory s'exécute comme un seul processus Node, stocke l'état sous forme de JSON sur le disque et est livré avec un visualiseur en temps réel sur le port 3113. Il est 100 % open source, tendance sur GitHub avec plus de 5 000 étoiles, et fonctionne avec Claude Code, Codex, Hermes, OpenClaw et Pi immédiatement.
D'autres outils que vous pourriez envisager
Axel vous aide à exécuter des agents IA et à les garder alimentés. Mettez en file d'attente les tâches, répartissez-les vers le bon agent, et approuvez ou refusez les actions depuis une seule boîte de réception. C'est natif macOS, piloté au clavier, et compatible avec Claude, Codex, OpenCode et Antigravity dès l'installation. Nous espérons que cela vous aidera à livrer plus vite 🚀
Qu'est-ce que 1Code ? Une application pour exécuter vos agents Claude Code en parallèle, qui fonctionne sur Mac et sur le Web. Sur Mac — exécutez localement, avec ou sans worktrees. Sur le Web — exécutez dans des sandbox distants avec des aperçus en direct de votre application, y compris sur mobile, afin de pouvoir surveiller les agents depuis n'importe où. Exécuter plusieurs Claude Code en parallèle a considérablement accéléré notre façon de développer des fonctionnalités.
Runsight est un moteur de workflow orienté YAML, conçu spécifiquement pour les agents d'IA , permettant aux développeurs de concevoir, valider, exécuter et évaluer des workflows d'agents avec un contrôle de version natif Git. Chaque workflow est stocké sous forme de fichier YAML dans votre dépôt, vous permettant de créer des branches, de réviser et de fusionner les modifications comme n'importe quel autre code. La plateforme propose un suivi des coûts en temps réel par exécution, avec des plafonds budgétaires stricts pour éviter les dépassements, ainsi qu'un cadre d'évaluation intégré pour les assertions et les tests de régression. "Livrez des agents comme vous livrez du code." Fonctionnalité Avantage Canvas + Éditeur YAML Vues visuelle et code en double Suivi des coûts par exécution Surveillez les dépenses au centime près Intégration Git Contrôle de version pour les workflows Il est entièrement auto-hébergé, s'exécute sur votre machine avec vos clés API, et est 100 % open source sous licence Apache 2.0.
Gemini 3.1 Flash-Lite exécute l'appel d'outils, la classification, la traduction et le traitement multimodal via l'API sur la plateforme Gemini Enterprise Agent de Google. Destiné aux ingénieurs IA qui construisent des pipelines d'agents à volume élevé et sensibles à la latence en production.
Créateur
indie_inkwell
Alternatives
Loading comments…