A · Agente filesystem-native
Baseline fuerte con archivos, búsqueda, shell/tools y libertad para organizar o reescribir información persistente.
research://memorybench
An architecture-neutral benchmark for persistent agent memory: measure continuity, temporal correctness, adaptation, latency and cost without rewarding one storage design by construction.
research://thesis
MemoryBench avoids a weak “chat history vs memory product” comparison. The benchmark gives a best-of-breed filesystem-native agent real tools to search, organize, rewrite and consolidate its own persistent workspace, then compares that baseline with SynapseFS and SynapseFS + SymbioRAP Memory under matched model, information and compute conditions.
focus://memorybench
Baseline fuerte con archivos, búsqueda, shell/tools y libertad para organizar o reescribir información persistente.
Mismas condiciones con persistencia determinista, identidades estables y semántica de evidencia/versiones.
Añade memoria episódica/semántica, temporal graph, consolidación y selección de contexto con provenance.
Modelo, acceso a información, tareas y compute budget se controlan para que el efecto arquitectónico sea interpretable.
architecture://working-model
El protocolo busca mostrar trade-offs, no producir un único score favorable. Mide si una arquitectura sigue siendo correcta con el tiempo, se adapta a hechos cambiados, recupera la evidencia adecuada y lo hace con latencia y presupuesto token/compute prácticos.
Respuestas correctas y uso adecuado de evidencia a corto y largo plazo.
Manejo correcto de hechos sustituidos, preferencias cambiadas y estado dependiente del tiempo.
Capacidad de revisar comportamiento cuando nueva evidencia contradice supuestos anteriores.
Overhead de retrieval/consolidation, tokens y compute necesarios para mantener calidad de memoria.
research://questions
¿Qué tareas requieren realmente una capa Memory dedicada frente a una buena organización filesystem?
¿Cuánta mejora aporta la semántica de persistencia por sí sola antes de añadir memoria semántica?
¿Qué políticas de consolidación mejoran precisión long-horizon sin crear memoria obsoleta o excesivamente segura?
¿Cómo evitar que los benchmarks premien memorization del modelo o atajos específicos de arquitectura?
status://research
Los puntos descritos son líneas de investigación e implementación, no promesas de funciones de producto terminadas.
connect://research
Con partners de investigación, financiación y tecnología compartimos cuestiones de arquitectura, diseño de benchmarks y estados técnicos de trabajo en un intercambio cualificado.
Siguiente paso útil
No necesita definir la solución técnica. Describa qué quiere crear o mejorar y evaluaremos viabilidad, primer alcance y siguientes pasos.
Evaluación gratuita de la idea
Cuatro campos bastan. Recibirá una respuesta concreta sobre cómo empezar pequeño y ampliar después.