Ningún modelo se ejecuta sobre tus memorias.
Nada de lo que envías se reescribe y el motor es barato, rápido y determinista. Nunca se ejecuta un modelo sobre tus memorias almacenadas. Tablet no usa ningún modelo; Scroll y Book añaden uno alrededor del motor para obtener mejores resultados, pero solo ve tu consulta, nunca lo que almacenaste.
- Motor determinista. El motor devuelve las mismas memorias para la misma consulta, siempre - por eso la varianza de nuestro benchmark proviene únicamente del modelo lector.
- Barato a escala. Sin costo de generación al almacenar o recuperar, así que tu factura sigue al almacenamiento - no al uso de modelos - a medida que la memoria crece.
Tus palabras, intactas
Un diseño común ejecuta un modelo de lenguaje al momento de escribir para extraer y reescribir "hechos" del texto. Ese diseño sacrifica tres cosas: costo de generación en cada escritura, latencia añadida y el almacenamiento de la paráfrasis de un modelo en lugar de las palabras originales. WOS hace el intercambio opuesto - no reescribe lo que se dijo y deja que tu LLM haga la interpretación al momento de leer, con el texto original en mano.
Lo que WOS no es: no es infraestructura que tengas que operar, ni un framework que tengas que ensamblar. Es una API alojada. Nunca se ejecuta un modelo sobre tus datos almacenados. Scroll y Book sí usan un modelo de lenguaje para obtener mejores resultados, pero solo ve tu consulta, nunca tus memorias almacenadas - y nunca entrena con tus datos ni los recopila.