Pague $2 para nós. Economize muitas vezes esse valor no seu LLM.
O WOS entrega ao seu LLM ~1,000 tokens por consulta - uma fatia limitada e relevante - em vez de enfiar o histórico completo em cada prompt. A diferença é enorme, e cresce junto com o seu histórico.
Custo do LLM por 1,000 consultas Com base no Tablet 1
Histórico do usuário100K
Consultas / mês1,000
Seu LLM
45× mais barato - você economiza $244/mês
Cada $1 gasto no WOS economiza ~$98 no LLM. Histórico maior ou modelo mais caro → ROI maior.
De onde vem a economia
- Sem o WOS, você enfia o histórico inteiro em cada prompt -
100K tokens × $2.50/1M = $0.25por consulta, às tarifas de entrada do GPT-4o (cerca de 2× isso em modelos do nível do Opus). - Com o WOS, você ingere uma única vez (
$2/1M) e cada consulta passa a ser uma pequena recuperação ($3/1M × 1,000) mais o seu LLM sobre apenas ~1,000 tokens. - Quanto menos tokens o seu LLM lê, menos você paga - e o WOS mantém esse número estável conforme a memória cresce.
Redução de contexto = histórico ÷ tokens entregues, não custo (a calculadora acima precifica cada recuperação). 25K → 21× · 100K → 83× · 200K → 167×.