Si usas modelos de IA con frecuencia, sabes que el coste puede dispararse sin que te des cuenta. Hoy comparto mis datos reales de consumo de DeepSeek API directa durante julio 2026, y los comparo con la alternativa de OpenCode Go (el plan flat de $10/mes).
📊 Los datos: 30 días de DeepSeek API directa
Periodo analizado: 2 al 31 de julio de 2026. Uso real, con mi asistente IA (Jane/OpenClaw) gestionando tareas diarias, crons, boletines, memoria y más.
💰 Costes
| Modelo | Coste (USD) | % del total |
|---|---|---|
| deepseek-v4-flash | $4.68 | 81% |
| deepseek-v4-pro | $1.12 | 19% |
| TOTAL | $5.80/mes | 100% |
Media diaria: $0.19 USD. Sí, menos de 20 céntimos al día.
🔢 Tokens procesados
| Modelo | Input total | Output | Hit rate | Requests |
|---|---|---|---|---|
| Flash | 343.7M | 2.75M | 93.8% | 7,448 |
| Pro | 62.4M | 261K | 97.5% | 708 |
| TOTAL | 406M | 3.0M | — | 8,156 |
El cache hit rate es la clave: un 94-97% de los tokens de entrada ya están en caché, lo que reduce drásticamente el coste. Sin caché, la factura sería 10 veces mayor.
📈 Picos de uso
- 16 de julio → $0.60 flash (861 peticiones) — sesión muy intensiva
- 27 de julio → $0.91 total ($0.28 flash + $0.63 pro) — el día más caro del mes
- 3 de julio → $0.49 flash (467 peticiones)
El 81% del gasto es flash, no pro. Solo usé deepseek-v4-pro cuatro días (20, 22, 27 y 28 de julio), y el 57% del coste de pro se concentró en un solo día.
⚖️ Comparativa con OpenCode Go ($10/mes)
OpenCode Go es un plan flat de $10/mes que incluye 23+ modelos: deepseek-v4-flash, qwen3.7-plus, kimi-k3, grok-4.5, MiniMax, y más. No incluye deepseek-v4-pro.
| Escenario | Coste/mes | Diferencia |
|---|---|---|
| A) API directa (actual) | $5.80 | — |
| B) Go (flash) + API (pro) | $11.12 | +$5.32 más caro |
| C) Go puro (todo) | $10.00 | +$4.20 más caro |
🎯 Conclusiones
- API directa es la opción ganadora para mi nivel de uso actual. $5.80 vs $10 de Go: casi la mitad.
- El cache hit es el verdadero ahorro. Con un 94-97% de aciertos, el coste se mantiene bajo a pesar de procesar 406 millones de tokens de entrada.
- Go solo compensaría si el uso creciera por encima de ~$10/mes (más del doble del actual). Más crons, más agentes, tareas más pesadas… ahí sí tendría sentido el flat.
- deepseek-v4-pro no está en Go. Si lo necesitas, igualmente pagas API directa aparte. Alternativas en Go: qwen3.7-plus y kimi-k3, ambos capaces.
- Recomendación general: si tu uso es moderado (<$10/mes), quédate con API directa. Si tu uso es intensivo o quieres simplicidad, Go puede merecer la pena.
🔧 Metodología
Datos extraídos de los CSVs de amount (tokens) y cost (gastos) de la API de DeepSeek, procesados con Python. El análisis completo se ejecuta con un script que calcula costes por modelo, hit rates, picos diarios y comparativa con OpenCode Go.
¿Y tú? ¿Cuánto gastas al mes en APIs de IA? ¿Usas planes flat o pay-per-use? Cuéntame en los comentarios 👇
No hay comentarios:
Publicar un comentario
Tolerancia cero con las faltas de respeto, palabras malsonantes y comentarios denigrantes sobre la sublime saga de Stars Wars..