Costo

Páganos $2. Ahorra muchas veces eso en tu LLM.

WOS entrega a tu LLM ~1,000 tokens por consulta - un fragmento acotado y relevante - en lugar de meter todo el historial en cada prompt. La diferencia es enorme, y crece con tu historial.

Costo de LLM por 1,000 consultas Basado en Tablet 1
Historial del usuario100K
Consultas / mes1,000
Tu LLM
45× más barato - ahorras $244/mes
Sin WOS$250.00
Con WOS$5.50

Cada $1 gastado en WOS ahorra ~$98 en el LLM. Un historial más grande o un modelo más caro → mayor ROI.

De dónde viene el ahorro

  • Sin WOS metes todo el historial en cada prompt - 100K tokens × $2.50/1M = $0.25 por consulta, a tarifas de entrada de GPT-4o (aproximadamente el doble en modelos de nivel Opus).
  • Con WOS ingieres una sola vez ($2/1M), y luego cada consulta es una recuperación diminuta ($3/1M × 1,000) más tu LLM sobre apenas ~1,000 tokens.
  • Cuantos menos tokens lea tu LLM, menos pagas - y WOS mantiene esa cifra estable a medida que la memoria crece.
Reducción de contexto = historial ÷ tokens entregados, no costo (la calculadora de arriba cotiza cada recuperación).  25K → 21× · 100K → 83× · 200K → 167×.