Architektur

Kein Modell läuft über Ihre Erinnerungen.

Was Sie senden, wird nicht umgeschrieben, und die Engine ist günstig, schnell und deterministisch. Über Ihren gespeicherten Erinnerungen läuft niemals ein Modell. Tablet nutzt gar kein Modell; Scroll und Book setzen für stärkere Ergebnisse eines um die Engine herum, doch es sieht immer nur Ihre Abfrage, nie das Gespeicherte.

  • Deterministische Engine. Die Engine liefert für dieselbe Abfrage jedes Mal dieselben Erinnerungen - deshalb stammt die Varianz in unserem Benchmark allein vom Reader-Modell.
  • Günstig im großen Maßstab. Keine Generierungskosten beim Speichern oder Abrufen - Ihre Rechnung folgt dem Speicherplatz, nicht der Modellnutzung, während das Gedächtnis wächst.

Ihre Worte, unangetastet

Ein verbreitetes Design lässt beim Schreiben ein Sprachmodell laufen, um "Fakten" aus dem Text zu extrahieren und umzuschreiben. Dieses Design bezahlt dreifach: Generierungskosten bei jedem Schreibvorgang, zusätzliche Latenz und die Speicherung der Paraphrase eines Modells statt der ursprünglichen Worte. WOS trifft die entgegengesetzte Wahl - es schreibt das Gesagte nicht um und lässt Ihr LLM die Interpretation zur Lesezeit übernehmen, mit dem Originaltext in der Hand.

Was WOS nicht ist: keine Infrastruktur, die Sie betreiben müssen, und kein Framework, das Sie zusammenbauen müssen. Es ist eine gehostete API. Über Ihre gespeicherten Daten läuft niemals ein Modell. Scroll und Book nutzen zwar ein Sprachmodell für stärkere Ergebnisse, doch es sieht immer nur Ihre Abfrage, nie Ihre gespeicherten Erinnerungen - und es trainiert niemals auf Ihren Daten oder sammelt sie.