
Ahora puedes darle a Hermes, Claude Code y Codex memoria infinita. Agentmemory está en tendencia en GitHub con más de 5,000 estrellas. CLAUDE md inyecta 22,000+ tokens en contexto con 240 observaciones agentmemory: 1,900 tokens. mismas observaciones. 92% menos. Con 1,000 observaciones, el 80% de tus recuerdos integrados se vuelven invisibles. agentmemory mantiene el 100% buscable. evaluado en 240 sesiones de codificación reales → Hasta un 95% menos de tokens por sesión → 200 veces más llamadas a herramientas antes de alcanzar los límites de contexto → 100% código abierto
Loading comments…
Información del proyecto
Palabras clave del producto
Agentmemory es un runtime de memoria completo diseñado específicamente para agentes de codificación como Hermes, Claude Code y Codex. En lugar de tratar la memoria como un complemento con almacenes vectoriales o bases de datos externas, Agentmemory proporciona a los agentes una memoria infinita y buscable que funciona desde el primer momento. Captura cada llamada a herramienta, indicación y parada de sesión como observaciones comprimidas, y las hace recuperables en milisegundos, todo desde un único proceso Node sin dependencias externas.
Agentmemory no depende de un único método de recuperación. Combina búsqueda léxica BM25, similitud vectorial y recorrido de grafos de conocimiento, y luego reordena los resultados en el dispositivo. El resultado es un 95.2% R@5 en LongMemEval-S con una latencia P50 inferior a 20 milisegundos en un portátil.
Doce hooks integrados canalizan cada evento PreToolUse, PostToolUse, SessionStart y Stop directamente al pipeline de memoria. Sin código de conexión, sin instrumentación manual: instala el plugin y cada acción del agente se convierte automáticamente en una observación comprimida.
Barridos horarios comprimen observaciones brutas en memorias semánticas, fusionan duplicados y eliminan filas obsoletas con puntuación de retención. Cada eliminación emite una fila de auditoría por lotes, para que siempre sepas qué se eliminó y por qué. Esto mantiene la memoria ligera sin perder señal.
Agentmemory expone un servidor MCP completo con herramientas como memory_save, memory_recall, memory_smart_search y memory_sessions. Cada herramienta MCP también tiene un gemelo REST en /agentmemory/*, para que puedas hacerle curl, obtenerla desde un navegador o proxy desde tu propio agente.
"Con 1.000 observaciones, el 80% de tus memorias integradas se vuelven invisibles. Agentmemory mantiene el 100% buscable."
Esa es la idea central detrás del diseño de Agentmemory. Los enfoques de memoria estándar pierden visibilidad a medida que el contexto crece: las observaciones quedan enterradas o se descartan. La recuperación de triple flujo y la consolidación horaria de Agentmemory garantizan que cada observación siga siendo buscable, independientemente del volumen. En sesiones de codificación evaluadas, esto se traduce en hasta un 95% menos de tokens por sesión y 200 veces más llamadas a herramientas antes de alcanzar los límites de contexto.
Estás cansado de que tu agente de codificación olvide lo que hizo hace dos sesiones, o de tener que configurar Redis, Kafka y un almacén vectorial solo para darle memoria persistente a un agente. Agentmemory se ejecuta como un único proceso Node, almacena el estado como JSON en disco e incluye un visor en tiempo real en el puerto 3113. Es 100% código abierto, tendencia en GitHub con más de 5.000 estrellas, y funciona con Claude Code, Codex, Hermes, OpenClaw y Pi desde el primer momento.
Creador
indie_inkwell
Alternativas
Otras herramientas que podrías considerar
Axel te ayuda a ejecutar agentes de IA y mantenerlos alimentados. Organiza el trabajo en cola, asígnalo al agente adecuado y aprueba o rechaza acciones desde una sola bandeja de entrada. Es nativo de macOS, se controla con el teclado y funciona con Claude, Codex, OpenCode y Antigravity de fábrica. Esperamos que te ayude a lanzar más rápido 🚀
¿Qué es 1Code? Una aplicación para ejecutar tus agentes de Claude Code en paralelo que funciona en Mac y Web. En Mac - ejecuta localmente, con o sin worktrees. En Web - ejecuta en sandboxes remotos con vistas previas en vivo de tu aplicación, incluida la versión móvil, para que puedas supervisar los agentes desde cualquier lugar. Ejecutar múltiples Claude Codes en paralelo aceleró drásticamente la forma en que desarrollamos funciones.
Runsight es un motor de flujos de trabajo basado en YAML diseñado específicamente para agentes de IA , que permite a los desarrolladores diseñar, confirmar, ejecutar y evaluar flujos de trabajo de agentes con control de versiones nativo de Git. Cada flujo de trabajo se almacena como un archivo YAML en tu repositorio, lo que te permite bifurcar, revisar y fusionar cambios como cualquier otro código. La plataforma ofrece seguimiento de costos en tiempo real por ejecución con límites de presupuesto estrictos para evitar gastos excesivos, junto con un marco de evaluación integrado para aserciones y pruebas de regresión. "Lanza agentes como lanzas código." Característica Beneficio Editor Canvas + YAML Vistas duales visual y de código Seguimiento de Costos por Ejecución Monitorea el gasto al centavo Integración con Git Control de versiones para flujos de trabajo Es completamente autoalojado, se ejecuta en tu máquina con tus claves API y es 100% de código abierto bajo la licencia Apache 2.0.
Gemini 3.1 Flash-Lite ejecuta llamadas a herramientas, clasificación, traducción y procesamiento multimodal a través de la API en la plataforma Gemini Enterprise Agent de Google. Está diseñado para ingenieros de IA que construyen pipelines de agentes de alto volumen y sensibles a la latencia en producción.
Loading comments…