Aucun modèle ne s'exécute sur vos souvenirs.
Ce que vous envoyez n’est pas réécrit, et le moteur est peu coûteux, rapide et déterministe. Aucun modèle n’est jamais exécuté sur vos souvenirs stockés. Tablet n’utilise aucun modèle ; Scroll et Book en ajoutent un autour du moteur pour de meilleurs résultats, mais il ne voit jamais que votre requête, jamais ce que vous avez stocké.
- Moteur déterministe. Le moteur renvoie les mêmes souvenirs pour la même requête, à chaque fois - c'est pourquoi la variance de notre benchmark provient uniquement du modèle lecteur.
- Économique à grande échelle. Aucun coût de génération pour stocker ou récupérer : votre facture suit le stockage - pas l'usage de modèle - à mesure que la mémoire grandit.
Vos mots, intacts
Une conception courante exécute un modèle de langage à l'écriture pour extraire et réécrire des « faits » à partir du texte. Cette conception sacrifie trois choses : un coût de génération à chaque écriture, une latence supplémentaire, et le stockage d'une paraphrase du modèle plutôt que des mots d'origine. WOS fait le choix inverse - il ne réécrit pas ce qui a été dit et laisse votre LLM interpréter à la lecture, le texte original en main.