Coût

Payez-nous $2. Économisez plusieurs fois ce montant sur votre LLM.

WOS fournit à votre LLM ~1,000 tokens par requête - une tranche bornée et pertinente - au lieu d'entasser l'historique complet dans chaque prompt. L'écart est énorme, et il grandit avec votre historique.

Coût LLM pour 1,000 requêtes Basé sur Tablet 1
Historique utilisateur100K
Requêtes / mois1,000
Votre LLM
45× moins cher - vous économisez $244/mois
Sans WOS$250.00
Avec WOS$5.50

Chaque $1 dépensé sur WOS fait économiser ~$98 sur le LLM. Un historique plus grand ou un modèle plus cher → un ROI plus grand.

D'où viennent les économies

  • Sans WOS, vous entassez l'historique entier dans chaque prompt - 100K tokens × $2.50/1M = $0.25 par requête, au tarif d'entrée de GPT-4o (environ 2× plus sur les modèles de classe Opus).
  • Avec WOS, vous ingérez une fois ($2/1M), puis chaque requête n'est qu'une petite récupération ($3/1M × 1,000) plus votre LLM sur seulement ~1,000 tokens.
  • Moins votre LLM lit de tokens, moins vous payez - et WOS garde ce nombre constant à mesure que la mémoire grandit.
Réduction de contexte = historique ÷ tokens fournis, pas le coût (le calculateur ci-dessus facture chaque récupération).  25K → 21× · 100K → 83× · 200K → 167×.