A · Agent filesystem-native
Baseline forte avec fichiers, recherche, shell/tools et liberté d’organiser ou réécrire l’information persistante.
research://memorybench
An architecture-neutral benchmark for persistent agent memory: measure continuity, temporal correctness, adaptation, latency and cost without rewarding one storage design by construction.
research://thesis
MemoryBench avoids a weak “chat history vs memory product” comparison. The benchmark gives a best-of-breed filesystem-native agent real tools to search, organize, rewrite and consolidate its own persistent workspace, then compares that baseline with SynapseFS and SynapseFS + SymbioRAP Memory under matched model, information and compute conditions.
focus://memorybench
Baseline forte avec fichiers, recherche, shell/tools et liberté d’organiser ou réécrire l’information persistante.
Mêmes conditions avec persistance déterministe, identités stables et sémantique evidence/version.
Ajoute mémoire épisodique/sémantique, temporal graph, consolidation et context selection avec provenance.
Modèle, accès à l’information, tâches et compute budget sont contrôlés pour isoler l’effet architectural.
architecture://working-model
Le protocole vise à révéler les trade-offs plutôt qu’à produire un score unique flatteur. Il mesure si une architecture reste correcte dans le temps, s’adapte aux faits modifiés, récupère la bonne evidence et le fait avec une latence et un budget token/compute pratiques.
Réponses correctes et bon usage de l’evidence sur horizons courts et longs.
Gestion correcte des faits remplacés, préférences modifiées et états dépendants du temps.
Capacité à réviser le comportement quand une nouvelle evidence contredit des hypothèses antérieures.
Overhead retrieval/consolidation, tokens et compute nécessaires au maintien de la qualité mémoire.
research://questions
Quelles tâches exigent réellement une couche Memory dédiée plutôt qu’une organisation filesystem disciplinée ?
Quel gain vient de la seule sémantique de persistance avant d’ajouter la mémoire sémantique ?
Quelles politiques de consolidation améliorent la précision long-horizon sans créer une mémoire obsolète ou trop sûre ?
Comment rendre les tâches de benchmark résistantes à la memorization du modèle et aux raccourcis spécifiques d’architecture ?
status://research
Les éléments décrits sont des orientations de recherche et d’implémentation, pas des fonctionnalités produit garanties.
connect://research
Avec des partenaires de recherche, de financement et de technologie, nous partageons questions d’architecture, conception des benchmarks et états techniques dans un échange qualifié.
Prochaine étape utile
Vous n’avez pas besoin de définir la solution technique. Décrivez ce que vous souhaitez créer ou améliorer ; nous évaluons faisabilité, premier périmètre et prochaines étapes.
Faire évaluer l’idée gratuitement
Quatre champs suffisent. Vous recevrez une réponse concrète sur la meilleure façon de commencer petit puis d’étendre.