Custo

Pague $2 para nós. Economize muitas vezes esse valor no seu LLM.

O WOS entrega ao seu LLM ~1,000 tokens por consulta - uma fatia limitada e relevante - em vez de enfiar o histórico completo em cada prompt. A diferença é enorme, e cresce junto com o seu histórico.

Custo do LLM por 1,000 consultas Com base no Tablet 1
Histórico do usuário100K
Consultas / mês1,000
Seu LLM
45× mais barato - você economiza $244/mês
Sem WOS$250.00
Com WOS$5.50

Cada $1 gasto no WOS economiza ~$98 no LLM. Histórico maior ou modelo mais caro → ROI maior.

De onde vem a economia

  • Sem o WOS, você enfia o histórico inteiro em cada prompt - 100K tokens × $2.50/1M = $0.25 por consulta, às tarifas de entrada do GPT-4o (cerca de 2× isso em modelos do nível do Opus).
  • Com o WOS, você ingere uma única vez ($2/1M) e cada consulta passa a ser uma pequena recuperação ($3/1M × 1,000) mais o seu LLM sobre apenas ~1,000 tokens.
  • Quanto menos tokens o seu LLM lê, menos você paga - e o WOS mantém esse número estável conforme a memória cresce.
Redução de contexto = histórico ÷ tokens entregues, não custo (a calculadora acima precifica cada recuperação).  25K → 21× · 100K → 83× · 200K → 167×.