31/7/26

Cuánto me cuesta DeepSeek al mes: análisis real de consumo vs OpenCode Go

Si usas modelos de IA con frecuencia, sabes que el coste puede dispararse sin que te des cuenta. Hoy comparto mis datos reales de consumo de DeepSeek API directa durante julio 2026, y los comparo con la alternativa de OpenCode Go (el plan flat de $10/mes).

📊 Los datos: 30 días de DeepSeek API directa

Periodo analizado: 2 al 31 de julio de 2026. Uso real, con mi asistente IA (Jane/OpenClaw) gestionando tareas diarias, crons, boletines, memoria y más.

💰 Costes

ModeloCoste (USD)% del total
deepseek-v4-flash$4.6881%
deepseek-v4-pro$1.1219%
TOTAL$5.80/mes100%

Media diaria: $0.19 USD. Sí, menos de 20 céntimos al día.

🔢 Tokens procesados

ModeloInput totalOutputHit rateRequests
Flash343.7M2.75M93.8%7,448
Pro62.4M261K97.5%708
TOTAL406M3.0M8,156

El cache hit rate es la clave: un 94-97% de los tokens de entrada ya están en caché, lo que reduce drásticamente el coste. Sin caché, la factura sería 10 veces mayor.

📈 Picos de uso

  • 16 de julio → $0.60 flash (861 peticiones) — sesión muy intensiva
  • 27 de julio → $0.91 total ($0.28 flash + $0.63 pro) — el día más caro del mes
  • 3 de julio → $0.49 flash (467 peticiones)

El 81% del gasto es flash, no pro. Solo usé deepseek-v4-pro cuatro días (20, 22, 27 y 28 de julio), y el 57% del coste de pro se concentró en un solo día.


⚖️ Comparativa con OpenCode Go ($10/mes)

OpenCode Go es un plan flat de $10/mes que incluye 23+ modelos: deepseek-v4-flash, qwen3.7-plus, kimi-k3, grok-4.5, MiniMax, y más. No incluye deepseek-v4-pro.

EscenarioCoste/mesDiferencia
A) API directa (actual)$5.80
B) Go (flash) + API (pro)$11.12+$5.32 más caro
C) Go puro (todo)$10.00+$4.20 más caro

🎯 Conclusiones

  1. API directa es la opción ganadora para mi nivel de uso actual. $5.80 vs $10 de Go: casi la mitad.
  2. El cache hit es el verdadero ahorro. Con un 94-97% de aciertos, el coste se mantiene bajo a pesar de procesar 406 millones de tokens de entrada.
  3. Go solo compensaría si el uso creciera por encima de ~$10/mes (más del doble del actual). Más crons, más agentes, tareas más pesadas… ahí sí tendría sentido el flat.
  4. deepseek-v4-pro no está en Go. Si lo necesitas, igualmente pagas API directa aparte. Alternativas en Go: qwen3.7-plus y kimi-k3, ambos capaces.
  5. Recomendación general: si tu uso es moderado (<$10/mes), quédate con API directa. Si tu uso es intensivo o quieres simplicidad, Go puede merecer la pena.

🔧 Metodología

Datos extraídos de los CSVs de amount (tokens) y cost (gastos) de la API de DeepSeek, procesados con Python. El análisis completo se ejecuta con un script que calcula costes por modelo, hit rates, picos diarios y comparativa con OpenCode Go.

¿Y tú? ¿Cuánto gastas al mes en APIs de IA? ¿Usas planes flat o pay-per-use? Cuéntame en los comentarios 👇

¿Qwen 3.7 plus o max? Comparativa de precios y uso real con OpenClaw

Llevo meses usando OpenClaw como asistente personal, con DeepSeek como proveedor principal. Pero hace poco me planteé una pregunta: ¿y si quiero usar modelos de Qwen? ¿Me conviene más Qwen 3.7 Plus o Qwen 3.7 Max?

La respuesta no es obvia. Depende de cuántos tokens consumo, qué tipo de tareas hago, si automatizo, y cuánto estoy dispuesto a pagar. Así que hice los números. Este post es el resultado.


0. ¿Qué es OpenCode Go?

OpenCode Go es un plan de suscripción de opencode.ai que ofrece acceso a múltiples modelos de IA por un precio fijo mensual. Es el plan más barato del mercado para acceso multi-modelo: 10 USD al mes (5 USD el primer mes).

Lo interesante de OpenCode Go no es solo el precio, sino qué incluye:

  • Acceso a 16+ modelos: Qwen 3.7 Max, Qwen 3.7 Plus, DeepSeek V4 Pro, DeepSeek V4 Flash, Kimi K3, GLM-5.2, Grok 4.5, MiniMax M3, MiMo-V2.5, Hy3, y más.
  • API compatible con OpenAI: funciona con OpenClaw, OpenCode, Claude Code, Cursor, y cualquier agente que hable el protocolo OpenAI.
  • Sin restricciones de automatización: puedes usarlo para scripts, agentes autónomos, crones, heartbeats, lo que quieras.
  • Límites por requests, no por tokens: cada modelo tiene un número máximo de requests por 5 horas, por semana y por mes.

La clave está en que no todos los modelos tienen los mismos límites. Algunos son muy generosos (DeepSeek V4 Flash: 31.650 requests/5h), otros son restrictivos (Qwen 3.7 Max: solo 950 requests/5h).

¿Y cuánto cuesta usar Qwen 3.7 Plus vs Max dentro de OpenCode Go? Vamos a los números.


1. Mi caso de uso: qué hago con OpenClaw

Antes de comparar modelos, necesito explicar cómo uso yo OpenClaw, porque los números de consumo varían mucho según el patrón de uso.

Uso OpenClaw a diario, con DeepSeek V4 Flash como modelo principal (97% del tiempo), y ocasionalmente DeepSeek V4 Pro (3%) para tareas más complejas. Estos son mis números reales de los últimos 30 días (junio-julio 2026):

  • Coste total: 5,37 USD/mes
  • Requests: ~260 al día / ~7.800 al mes
  • Tokens de entrada: 443 millones al mes
  • Tokens de salida: ~3 millones al mes
  • Cache hits: 95% de los tokens de entrada (DeepSeek los cobra a 0,0028 USD/1M, prácticamente regalados)

¿Qué tipo de tareas hago?

Mi uso de OpenClaw no es solo coding. Es un asistente personal con automatizaciones:

  • Boletín de noticias IA diario (7:15 AM): genera guion desde NewsAPI, locuta con Azure TTS, publica en Spreaker y redes. ~16.000 tokens de salida por boletín.
  • Eventos del día (8:00 AM): consulta Google Calendar y me avisa por Telegram. ~500 tokens por ejecución.
  • Revisión de Gmail: busca nóminas, facturas. ~2.000 tokens por búsqueda.
  • Heartbeats periódicos: cada 30 min, revisa correo, calendario, tareas. ~1.000 tokens por heartbeat.
  • Chat conversacional: respuestas a preguntas, análisis de documentos, redacción de correos. ~500-2.000 tokens por respuesta.
  • Automatizaciones varias: actualización de Notion (gastos, peso, facturas), Google Sheets (donaciones), generación de audio con Azure TTS, publicación en redes.

En total, son entre 5 y 8 tareas automatizadas al día, más heartbeats cada 30 min, más chat conversacional. Todo esto con DeepSeek V4 Flash, que es barato gracias a los cache hits.

¿Cambiaría el patrón de uso con Qwen 3.7? No fundamentally. Las mismas tareas, pero con otro modelo. La pregunta es: ¿cuánto me costaría?


2. Qwen 3.7 Plus vs Max: diferencias, precios y habilidades

Qwen 3.7 es la familia de modelos de Alibaba Cloud. Hay dos versiones principales disponibles vía API: Plus y Max. No son solo "versiones pequeña y grande del mismo modelo". Son arquitecturas diferentes con casos de uso diferentes.

Qwen 3.7 Plus

  • Tipo: modelo multimodal (texto + imagen + vídeo)
  • Contexto: hasta 1 millón de tokens
  • Habilidades clave:
    • Percepción de escenas reales, lectura de pantallas, interacción con GUIs
    • Generación de código desde imágenes o descripciones
    • Agente híbrido interactivo multi-modal
    • Soporta preserve_thinking para razonamiento extendido
  • Precio (API directa o OpenCode Go):
    • ≤256K tokens: 0,40 USD input / 1,60 USD output por 1M tokens
    • >256K tokens: 1,20 USD input / 4,80 USD output por 1M tokens
  • Límites en OpenCode Go: 4.300 requests/5h, ~21.600 requests/mes

Qwen 3.7 Max

  • Tipo: modelo flagship, reasoning-native, cerrado (no open-weight)
  • Contexto: 1 millón de tokens
  • Habilidades clave:
    • Modo nativo de pensamiento extendido (extended thinking)
    • Compatible con protocolo Anthropic Messages (drop-in para Claude Code)
    • Ejecución autónoma sostenida: puede trabajar en tareas de 35+ horas sin intervención
    • Frontier coding agent: diseño frontend, razonamiento complejo, coding largo
    • Benchmarks: 88.4 GPQA Diamond, 91.3 AIME 2026, 83.6 LiveCodeBench v6
  • Precio (API directa o OpenCode Go): 2,50 USD input / 7,50 USD output por 1M tokens
  • Límites en OpenCode Go: 950 requests/5h, ~4.770 requests/mes

Comparación directa

Aspecto Qwen 3.7 Plus Qwen 3.7 Max
Precio input (1M tokens) 0,40 USD 2,50 USD
Precio output (1M tokens) 1,60 USD 7,50 USD
Requests/mes (OpenCode Go) ~21.600 ~4.770
Contexto 1M tokens 1M tokens
Multi-modal (imagen/vídeo) ✅ Sí ❌ No (solo texto)
Extended thinking nativo ✅ Sí (preserve_thinking) ✅ Sí (nativo)
Agente autónomo largo (35h+) ❌ No ✅ Sí
Frontier coding agent ✅ Bueno ✅ Excelente
Open-weight ❌ No ❌ No

En resumen: Max es ~6x más caro en input y ~4.7x más caro en output. Pero Max es el modelo flagship para tareas de razonamiento complejo, coding autónomo largo, y diseño frontend. Plus es más barato, multi-modal, y tiene más requests disponibles.


3. ¿Cómo funcionaría cada uno con OpenClaw a nivel agéntico?

OpenClaw es un agente que puede usar herramientas, automatizar tareas, y mantener conversaciones multi-turno. La pregunta es: ¿cómo se comporta Qwen 3.7 Plus vs Max dentro de OpenClaw?

Qwen 3.7 Plus en OpenClaw

Casos de uso ideales:

  • Chat conversacional: respuestas rápidas, análisis de documentos, redacción de correos. Plus es suficiente y barato.
  • Tareas multi-modales: si necesitas que el agente analice imágenes (capturas de pantalla, fotos de documentos, gráficos), Plus es la única opción (Max no soporta imagen).
  • Automatizaciones rutinarias: heartbeats, revisión de correo, actualización de bases de datos. Plus tiene 21.600 requests/mes, suficiente para ~720 requests/día.
  • Generación de guiones: para boletines de noticias, podcasts, vídeos. Plus genera texto de calidad a bajo coste.

Limitaciones:

  • No puede sostener tareas autónomas de 35+ horas sin intervención.
  • Para razonamiento matemático/científico muy complejo, puede quedarse corto.
  • Frontend design es bueno, pero no al nivel de Max.

Qwen 3.7 Max en OpenClaw

Casos de uso ideales:

  • Coding agent autónomo: si necesitas que OpenClaw refactorice un código grande, haga migraciones complejas, o trabaje en un proyecto de múltiples archivos durante horas, Max es la opción.
  • Razonamiento complejo: análisis teológico profundo, matemáticas avanzadas, lógica compleja. Max tiene extended thinking nativo y benchmarks superiores.
  • Diseño frontend: si OpenClaw genera interfaces web, Max produce código más limpio y estético.
  • Tareas de larga duración: Max puede trabajar de forma autónoma durante 35+ horas en tareas de largo horizonte.

Limitaciones:

  • Solo 4.770 requests/mes en OpenCode Go. Eso son ~160 requests/día. Si haces heartbeats cada 30 min (48/día) + 10-20 tareas automáticas/día + chat conversacional, te quedas sin requests rápido.
  • No soporta imagen/vídeo. Si necesitas análisis visual, tienes que usar Plus u otro modelo.
  • 6x más caro si usas la API directa.

Mi evaluación para mi caso de uso

Para mi patrón de uso (260 requests/día, 95% tareas rutinarias, 5% tareas complejas):

  • Qwen 3.7 Plus: cubriría el 95% de mis tareas. Los 21.600 requests/mes son suficientes para mis 7.800 requests/mes actuales. Y el precio es 6x menor.
  • Qwen 3.7 Max: solo lo usaría para el 5% de tareas complejas (análisis teológico, razonamiento matemático, coding autónomo largo). Pero con solo 4.770 requests/mes, tendría que ser muy selectivo.

Conclusión: para uso diario como asistente personal con automatizaciones, Plus es más práctico. Max es overkill para el 95% de las tareas, y te quedas sin requests rápido.


4. Costes reales: OpenCode Go vs API directa vs Qwen Token Plan

Ahora la pregunta del millón: ¿cuánto me costaría usar Qwen 3.7 con mi patrón de uso actual?

Voy a calcularlo para tres escenarios:

  1. OpenCode Go (suscripción de 10 USD/mes, límites por requests)
  2. API directa de Qwen (pay-as-you-go, pago por tokens)
  3. Qwen Token Plan (suscripción con créditos, pero con restricciones)

Escenario 1: OpenCode Go

OpenCode Go cuesta 10 USD/mes y te da límites por requests, no por tokens. Los límites son:

  • Qwen 3.7 Plus: 4.300 requests/5h, ~21.600 requests/mes
  • Qwen 3.7 Max: 950 requests/5h, ~4.770 requests/mes

Mi uso actual: ~260 requests/día, ~7.800 requests/mes.

¿Entra en Plus? Sí. 7.800 requests/mes está muy por debajo de los 21.600 requests/mes de Plus. Podría hacer todas mis tareas con Plus sin tocar el límite.

¿Entra en Max? No. 7.800 requests/mes supera los 4.770 requests/mes de Max. Tendría que reducir mi uso a ~160 requests/día, lo cual es inviable para mi patrón actual.

Coste con OpenCode Go:

  • Plus: 10 USD/mes (el plan completo, que incluye acceso a todos los modelos)
  • Max: no viable con mi uso actual (me quedaría sin requests a mitad de mes)

Escenario 2: API directa de Qwen (pay-as-you-go)

Si uso la API directa de Qwen (vía DashScope o Alibaba Cloud Model Studio), pago por tokens consumidos. Los precios son los mismos que en OpenCode Go, pero sin límites de requests.

Cálculo con mi uso actual:

  • Tokens de entrada: 443M/mes (pero el 95% son cache hits, que se cobran a 0,0028 USD/1M en DeepSeek, no en Qwen)
  • Tokens de salida: 3M/mes

Problema: Qwen no tiene cache hits como DeepSeek. En Qwen, todos los tokens de entrada se cobran al precio normal (0,40 USD/1M para Plus, 2,50 USD/1M para Max).

Coste con Qwen 3.7 Plus (API directa):

  • Input: 443M tokens × 0,40 USD/1M = 177,20 USD/mes
  • Output: 3M tokens × 1,60 USD/1M = 4,80 USD/mes
  • Total: 182 USD/mes

Coste con Qwen 3.7 Max (API directa):

  • Input: 443M tokens × 2,50 USD/1M = 1.107,50 USD/mes
  • Output: 3M tokens × 7,50 USD/1M = 22,50 USD/mes
  • Total: 1.130 USD/mes

¡Ouch! La API directa de Qwen es 34x más cara que DeepSeek para Plus, y 210x más cara para Max. ¿Por qué? Porque DeepSeek tiene cache hits que reducen el coste de input a 0,0028 USD/1M, mientras que Qwen cobra 0,40 USD/1M (Plus) o 2,50 USD/1M (Max) por todos los tokens de entrada.

Conclusión: la API directa de Qwen es inviable para mi patrón de uso. Solo tiene sentido si consumes muchos menos tokens (por ejemplo, si no tienes heartbeats cada 30 min, o si usas contextos mucho más cortos).

Escenario 3: Qwen Token Plan

Qwen ofrece un Token Plan con tres niveles:

Plan Precio Créditos/7 días Créditos/5 horas
Lite ~6 USD/mes 2.500 700
Standard ~18 USD/mes 10.000 3.000
Pro ~68 USD/mes 40.000 12.000

Los créditos se consumen según el modelo y los tokens. Según el ejemplo oficial de Qwen, una llamada de ~50.000 tokens a qwen3.6-plus consume ~3,18 créditos. Aplicando esa proporción a mi uso:

  • Consumo diario estimado: ~554 créditos
  • Consumo semanal: ~3.878 créditos

¿Qué plan necesito?

  • Lite (6 USD): 2.500 créditos/semana. No alcanza (necesito 3.878).
  • Standard (18 USD): 10.000 créditos/semana. Sí alcanza, con margen.
  • Pro (68 USD): 40.000 créditos/semana. Sobra, pero es caro.

Coste con Qwen Token Plan:

  • Standard: ~18 USD/mes

Pero hay un problema grave: los términos de uso del Token Plan prohíben la automatización:

"No API automation: Use is limited to interactive use within programming and agent tools. Using the API Key for automated scripts, application backends, or non-interactive batch processing is prohibited."

Esto significa que no puedo usar el Token Plan para mis automatizaciones (boletín diario, heartbeats, revisión de correo, etc.). Solo puedo usarlo para chat interactivo. Para mí, eso lo hace inviable.

Resumen de costes

Opción Coste mensual ¿Viable para mi uso? ¿Automatización?
DeepSeek (actual) 5,37 USD ✅ Sí ✅ Sí
OpenCode Go (Plus) 10 USD ✅ Sí (21.600 req/mes) ✅ Sí
OpenCode Go (Max) 10 USD ❌ No (solo 4.770 req/mes) ✅ Sí
API directa Qwen (Plus) 182 USD ✅ Sí (sin límites) ✅ Sí
API directa Qwen (Max) 1.130 USD ✅ Sí (sin límites) ✅ Sí
Qwen Token Plan (Standard) ~18 USD ✅ Sí (10.000 créditos/sem) ❌ Prohibida

Ganador claro: DeepSeek a 5,37 USD/mes, gracias a los cache hits. OpenCode Go a 10 USD/mes es la segunda opción más barata, y me da acceso a Qwen 3.7 Plus si quiero probarlo.


5. ¿Y Ollama Cloud? Estimación de costes

Ollama Cloud es el servicio de inferencia gestionada de Ollama. No cobra por tokens, sino por tiempo de GPU. Los planes son:

Plan Precio Uso cloud Modelos concurrentes
Free 0 USD Ligero (experimentar) 1
Pro 20 USD/mes 50× Free 3
Max 100 USD/mes 250× Free 10

Ollama Cloud no tiene Claude (Anthropic no permite que sus modelos se usen en plataformas de terceros). Pero tiene modelos open como:

  • DeepSeek V4 Flash (el mismo que uso ahora)
  • DeepSeek V4 Pro
  • Nemotron 3 Ultra (NVIDIA)
  • Qwen 3.5, 3.6, 3.7 (familia completa)
  • Kimi K2.6, K2.7, K3
  • GLM-5.1, GLM-5.2
  • GPT-OSS (open-weight de OpenAI)
  • Gemma 4 (Google)
  • Mistral Large 3
  • Y más

¿Me conviene Ollama Cloud para mi uso?

El plan que necesitaría es el Pro (20 USD/mes), porque el Free es solo para experimentar.

Ventajas:

  • Facturación fija: 20 USD/mes, sin sorpresas.
  • Sin restricciones de automatización: puedes usarlo para scripts, agentes, crones, heartbeats.
  • Acceso a 40+ modelos: no solo Qwen, también DeepSeek, Kimi, GLM, Gemma, Mistral, etc.
  • 3 modelos concurrentes: puedo tener OpenClaw usando un modelo mientras otra herramienta usa otro.
  • Privacidad: "Prompt or response data is never logged or trained on."

Desventajas:

  • 20 USD/mes vs 5,37 USD/mes de DeepSeek: son 15 USD más al mes. ¿Valen la pena?
  • Límites por GPU time: Ollama no publica cifras exactas de minutos de GPU por plan. El plan Pro está diseñado para "day-to-day work", pero si mi uso es muy intensivo, podría tocar el límite.
  • No tiene Claude: si algún día quiero usar Sonnet u Opus, tendré que ir a otra plataforma.

Estimación: ¿cuánto uso puedo meter en Ollama Pro?

Ollama mide el uso por tiempo de GPU, no por tokens. Esto hace que la comparación directa con DeepSeek no sea exacta. Pero podemos hacer una estimación:

  • Plan Free: ~10-20 requests/día con modelos de nivel 3-4 (como DeepSeek V4 Flash).
  • Plan Pro: 50× Free = ~500-1.000 requests/día.

Mi uso actual: ~260 requests/día con DeepSeek V4 Flash.

Cálculo: mi uso actual representa entre el 26% y el 52% de la capacidad del plan Pro. Dicho al revés: con Ollama Pro podría hacer entre 2 y 4 veces mi uso actual antes de tocar el límite.

Traducido a cosas concretas, con Ollama Pro a 20 USD podría:

  • Seguir usando OpenClaw exactamente igual que ahora (~260 req/día)
  • Y además usar OpenCode con un modelo como Qwen 3.5 Coder o Kimi K2.7 Code para ~100-150 req/día de programación
  • Y además ejecutar un agente tipo Hermes para tareas de investigación (~50 req/día)
  • Y aún me sobraría margen para picos puntuales de uso

¿Me conviene? Depende de cuánto valore la predictibilidad y la libertad de modelos. Si DeepSeek sigue funcionando bien sin sorpresas, la diferencia de 15 USD/mes no se justifica solo por el ahorro. Pero si algún día DeepSeek cambia sus precios de caché o mete restricciones, Ollama Pro es la alternativa más sólida.


6. Conclusiones

Después de hacer los números y probar modelos, estas son mis conclusiones finales:

1. Me quedo con Qwen 3.7 Plus

Qwen 3.7 Plus es mi elección por dos razones principales:

  • Es multimodal: acepta texto, imagen y vídeo. Max solo acepta texto. Si quiero que OpenClaw analice una captura de pantalla, un documento escaneado o un gráfico, Plus es la única opción dentro de Qwen 3.7.
  • Es 6 veces más barato que Max: 0,40 USD/1M tokens input vs 2,50 USD/1M de Max. En output, 1,60 USD vs 7,50 USD. Para el 95% de mis tareas, Plus rinde igual que Max pero cuesta mucho menos.

2. DeepSeek V4 Flash tiene fallos puntuales

DeepSeek V4 Flash es mi daily driver (5,37 USD/mes gracias a los cache hits), pero no es perfecto. De vez en cuando tiene fallos puntuales en tareas cotidianas:

  • Algunos scripts de automatización se atascan o generan código incorrecto que requiere reintentos.
  • En tareas de razonamiento medio (no complejo, pero tampoco trivial), a veces toma atajos incorrectos.
  • Estos fallos son pocos (quizás 1 de cada 20-30 tareas), pero ocurren.

Para el 95% de mi uso (JSON, clasificación, extracción, código corto), Flash funciona perfectamente. Pero para ese 5% de tareas que requieren un poco más de razonamiento, necesito un modelo más capaz.

3. Comparación: DeepSeek V4 Pro vs Qwen 3.7 Plus

Aquí viene la pregunta interesante: ¿DeepSeek V4 Pro o Qwen 3.7 Plus para las tareas que requieren más capacidad?

Aspecto DeepSeek V4 Pro Qwen 3.7 Plus
Precio input (1M tokens) 0,435 USD 0,40 USD
Precio output (1M tokens) 0,87 USD 1,60 USD
Cache hit input 0,003625 USD 0,04 USD
Contexto 1M tokens 1M tokens
Max output 384K tokens 64K tokens
Multi-modal ❌ No (solo texto) ✅ Sí (texto + imagen + vídeo)
Modos de razonamiento 3 modos (Non-Thinking, Thinking High, Thinking Max) ✅ Sí (preserve_thinking)
Licencia MIT (open-weight) ❌ No (API propietaria)
Parámetros 1.6T total, 49B activos No publicado
Mejor en Razonamiento complejo, coding largo, matemáticas Tareas multi-modales, análisis visual, generación de código desde imágenes

Análisis:

  • Precio: son muy similares en input (~0,40-0,43 USD/1M). Pero DeepSeek V4 Pro es casi 2x más barato en output (0,87 vs 1,60 USD/1M). Y con cache hits, DeepSeek baja a 0,003625 USD/1M, mientras que Qwen baja a 0,04 USD/1M. DeepSeek gana en precio si tienes cache hits altos.
  • Capacidad de output: DeepSeek V4 Pro puede generar hasta 384K tokens de salida, mientras que Qwen 3.7 Plus solo 64K. Si necesitas generar documentos largos, código extenso o análisis detallados, DeepSeek gana.
  • Multi-modal: Qwen 3.7 Plus acepta imagen y vídeo; DeepSeek V4 Pro solo texto. Si necesitas análisis visual, Qwen gana.
  • Razonamiento: DeepSeek V4 Pro tiene 3 modos de razonamiento (incluyendo Thinking Max para tareas muy complejas). Qwen 3.7 Plus tiene extended thinking, pero no tan flexible. DeepSeek gana en razonamiento puro.
  • Open-weight: DeepSeek V4 Pro es MIT, puedes self-host. Qwen 3.7 Plus es API propietaria. DeepSeek gana si quieres control total.

Conclusión de la comparación: DeepSeek V4 Pro es mejor para razonamiento complejo, coding largo y tareas de solo texto. Qwen 3.7 Plus es mejor para tareas multi-modales (imagen/vídeo) y es ligeramente más barato en input.

4. Me quedo con Qwen 3.7 Plus en OpenCode Go

A pesar de que DeepSeek V4 Pro es más capaz en razonamiento, me quedo con Qwen 3.7 Plus en OpenCode Go por una razón práctica: los límites de OpenCode Go superan mi consumo habitual.

Mis números:

  • Mi consumo actual: ~260 requests/día, ~7.800 requests/mes
  • Límite de Qwen 3.7 Plus en OpenCode Go: 4.300 requests/5h, ~21.600 requests/mes
  • Margen: 21.600 - 7.800 = 13.800 requests de margen (casi el doble de mi uso actual)

¿Qué significa esto? Que puedo usar Qwen 3.7 Plus en OpenCode Go para todas mis tareas (heartbeats, boletines, chat, automatizaciones) sin preocuparme por tocar el límite. Y todo por 10 USD/mes (el precio de OpenCode Go), que incluye acceso a 16+ modelos.

Comparación con DeepSeek V4 Pro en OpenCode Go:

  • DeepSeek V4 Pro en OpenCode Go: 3.450 requests/5h, ~17.150 requests/mes
  • Mi consumo: 7.800 requests/mes
  • Margen: 17.150 - 7.800 = 9.350 requests

Ambos modelos me dan margen suficiente en OpenCode Go. Pero Qwen 3.7 Plus tiene dos ventajas:

  1. Es multimodal: puedo analizar imágenes y vídeos, algo que DeepSeek V4 Pro no puede hacer.
  2. Tiene más requests disponibles: 21.600 vs 17.150 requests/mes. Si mi uso crece, Plus me da más margen.

Resumen final

  • Daily driver: DeepSeek V4 Flash (5,37 USD/mes vía API directa). Barato gracias a los cache hits, aunque tiene fallos puntuales en tareas cotidianas.
  • Para tareas que requieren más capacidad: Qwen 3.7 Plus vía OpenCode Go (10 USD/mes). Multimodal, 6x más barato que Max, y los límites de OpenCode Go (21.600 requests/mes) superan mi consumo habitual (7.800 requests/mes).
  • Para razonamiento muy complejo: DeepSeek V4 Pro (también en OpenCode Go, 17.150 requests/mes) o Nemotron 3 Ultra (Ollama Cloud). Pero los uso poco.
  • Descartados: Qwen 3.7 Max (overkill, solo 4.770 requests/mes en OpenCode Go), Qwen Token Plan (prohíbe automatización), API directa de Qwen (182 USD/mes para Plus, inviable).

¿Y si DeepSeek cambia sus precios de caché? Si eso ocurre, OpenCode Go es mi plan B: 10 USD/mes, acceso a Qwen 3.7 Plus, DeepSeek V4 Pro, y otros 14 modelos, sin restricciones de automatización. Y si necesito aún más libertad, Ollama Cloud Pro (20 USD/mes, 40+ modelos).

¿Y si necesito análisis visual? Qwen 3.7 Plus es la opción. Acepta imagen y vídeo, algo que DeepSeek V4 Pro no puede hacer.

¿Y si necesito coding agent autónomo largo? Qwen 3.7 Max es el modelo (35+ horas de ejecución autónoma), pero solo tiene 4.770 requests/mes en OpenCode Go. Para eso, mejor uso DeepSeek V4 Pro o Nemotron 3 Ultra.


¿Tú qué usas? ¿Has probado Qwen 3.7 Plus o DeepSeek V4 Pro con OpenClaw? ¿Prefieres facturación fija o pay-as-you-go? Cuéntamelo en los comentarios.

📚 Enlaces útiles:

28/7/26

OpenCode Go al detalle: cuántos requests y tokens obtienes con $10/mes (modelo por modelo)

📊 OpenCode Go al detalle

Cuántos requests y tokens obtienes con $10/mes, modelo por modelo

La semana pasada me puse a revisar los planes de pago de OpenCode Go y hasta ahora solo había comparado costes totales. Pero me quedé con la curiosidad: ¿cuánto rendimiento saco realmente de cada modelo con los $10 del plan básico?

Así que le pedí a Jane, mi asistente IA, que sacara los números: cogió mi consumo real del último mes (7.800 requests, 443 millones de tokens de entrada, 3 millones de salida) y lo proyectó contra cada uno de los 23 modelos disponibles en OpenCode Go, usando sus precios reales por token. Aquí están los resultados.

📍 Recordatorio: mi consumo de referencia

Estos son mis números reales del último mes con DeepSeek directo (97% deepseek-v4-flash, 3% deepseek-v4-pro):

Concepto Valor
Requests al mes 7.800
Tokens de entrada (totales) 443 millones
→ De los cuales, caché 95%
Tokens de salida 3 millones
Coste real con DeepSeek directo 5,37 USD

Cada request consume de media ~57.000 tokens de entrada y ~385 de salida. Con esa referencia, Jane calculó cuánto costaría mantener ese mismo volumen con cada modelo de OpenCode Go.

🧮 Modelos gratis: sin límite de tokens

Lo primero que descubrimos es que OpenCode Go incluye 3 modelos totalmente gratis en el plan de $10/mes. No consumen crédito por token. El único límite son 5 horas semanales de computación:

  • ✅ HY3 Preview — 262K de contexto, thinking
  • ✅ MiMo V2 Omni — texto + imagen, 262K de contexto
  • ✅ MiMo V2 Pro — solo texto, 1M de contexto

Si tu uso es moderado, puedes vivir todo el mes sin pagar ni un centavo extra.

💰 Modelos de pago: lo que obtienes con $10

Para los modelos de pago, el plan de $10 te da un crédito que se consume a diferentes velocidades según el modelo. La tabla muestra cuántos requests/mes puedes hacer con $10 y cómo se compara con tu consumo actual:

Modelo $10 = Requests Input/mes Output/mes vs 7.800
DeepSeek V4 Flash 4.960 282M 1,9M – 36%
Qwen3.5 Plus 4.740 269M 1,8M – 39%
HY3 3.985 226M 1,5M – 49%
MiniMax M2.5 3.410 194M 1,3M – 56%
Qwen3.7 Plus 2.557 145M 1,0M – 67%
MiniMax M2.7 2.197 125M 0,8M – 72%
MiMo V2.5 1.607 91M 0,6M – 79%
Kimi K2.5 1.211 69M 0,5M – 84%
MiniMax M3 1.098 62M 0,4M – 86%
DeepSeek V4 Pro 709 40M 0,3M – 91%
Kimi K3 328 19M 0,1M – 96%
Grok 4.5 413 23M 0,2M – 95%
Qwen3.7 Max 270 15M 0,1M – 97%

🔍 ¿Qué significa esto en la práctica?

La gran sorpresa ha sido descubrir que OpenCode Go es entre 4 y 80 veces más caro que DeepSeek directo para el mismo volumen de uso. La razón principal no es el precio base del token, sino que el cacheRead cuesta 10× en OpenCode Go ($0,028/M vs $0,0028/M de DeepSeek). Como el 95% de mis tokens de entrada son caché, ese multiplicador se nota muchísimo.

Con $10/mes en OpenCode Go usando DeepSeek V4 Flash obtengo ~4.960 requests, que es un 36% menos de los 7.800 que hago ahora con DeepSeek directo por solo $5,37.

Pero hay matices importantes:

  • Los 3 modelos gratis (HY3 Preview, MiMo V2 Omni, MiMo V2 Pro) son una oportunidad real: puedes tirar de ellos para tareas de clasificación, extracción o automatización sin consumir crédito.
  • Modelos premium como Kimi K3 o Qwen3.7 Max se comen el plan en 1 o 2 días. Solo merecen la pena para tareas muy concretas donde realmente superen a alternativas más baratas.
  • OpenCode Go te da acceso a modelos que DeepSeek no tiene: Kimi K2.5/2.6/2.7, toda la familia GLM, MiMo V2.5, HY3, etc. Si necesitas uno de esos, el plan merece la pena aunque sea más caro.
  • Si mantienes DeepSeek directo para el volumen base y usas OpenCode Go solo para los modelos exclusivos, aprovechas lo mejor de ambos mundos.

💡 Mi estrategia actual

Después de este análisis, he configurado OpenClaw así:

  1. Modelo principal: opencode-go/deepseek-v4-flash — para el día a día, automatizaciones, crons.
  2. Fallback 1: deepseek/deepseek-v4-flash (directo) — para cuando el plan de OpenCode Go se acerque al límite.
  3. Fallback 2: ollama-cloud/nemotron-3-ultra — para razonamiento complejo cuando no hay prisas.
  4. Uso táctico: DeepSeek directo para el volumen alto; OpenCode Go como "pasarela" a modelos que no tengo por otras vías.

En total, entre DeepSeek directo (~$5-6/mes) y OpenCode Go ($10/mes), me sale por unos $15-16 al mes para tener acceso a más de 20 modelos y mantener mi ritmo de automatización. Me parece un precio más que razonable para lo que saco de esto.

💬 Datos reales, no estimaciones de laboratorio. Todos los números provienen de mi cuenta de DeepSeek y de los precios oficiales del catálogo de OpenCode Go. Jane, mi asistente, los recopiló, calculó y organizó automáticamente en una sesión.


🔗 Enlaces

Publicado el 28 de julio de 2026 • Categoría: IA, costes, automatización

🧰 ¿Entonces qué es mejor: ¿OpenCode Go o DeepSeek directo?

Después de ver los números, la respuesta depende de para qué lo quieras:

Caso 1: Solo usas DeepSeek V4 Flash

DeepSeek directo gana por goleada. Pagas la mitad ($5,37 vs $10) y obtienes 57% más capacidad (7.800 vs 4.960 requests). El cacheRead cuesta 10× menos en DeepSeek directo, que es lo que marca la diferencia cuando el 95% de tus tokens son caché. Por $10 de saldo en DeepSeek te da para casi 2 meses.

Caso 2: Quieres acceder a modelos que DeepSeek no tiene

Aquí OpenCode Go es necesario. DeepSeek directo solo te da Flash, Pro y Reasoner. OpenCode Go te da Kimi K2.5/2.6/2.7, toda la familia GLM 5/5.1/5.2, MiMo V2.5, HY3, Qwen3.7 Max/Plus, Grok 4.5… y 3 modelos gratis (HY3 Preview, MiMo V2 Omni, MiMo V2 Pro) que no consumen crédito.

Mi estrategia recomendada

Si quieres lo mejor de ambos mundos:

  1. DeepSeek directo como principal ($5-6/mes) — para el volumen diario de automatizaciones, crons y la mayoría de requests.
  2. OpenCode Go como complemento ($10/mes) — para los modelos que DeepSeek no tiene y los 3 modelos gratis que no consumen crédito.
  3. Así tienes ~$15-16/mes total con acceso a 23 modelos y sin perder capacidad de proceso.

Y si quieres ahorrar al máximo

Cancela OpenCode Go y quédate solo con DeepSeek directo. Te cunde más, te sale más barato, y por $10 de saldo tienes casi 2 meses completos de uso intensivo. Los modelos exclusivos de OpenCode Go molan, pero ¿realmente los necesitas todos los meses?


📓 Nota: El plan de OpenCode Go se renueva cada mes. Si tienes dudas sobre cuándo vence el tuyo, revisa tu correo o el dashboard de OpenCode. Se puede cancelar en cualquier momento desde su web.

26/7/26

Euskal Encounter, los vídeos

🎮 Euskal Encounter 34

Todos los vídeos desde el BEC de Barakaldo

Este fin de semana (23-26 de julio de 2026) se ha celebrado la Euskal Encounter 34 en el BEC de Barakaldo, y he estado allí para traeros toda la experiencia en vídeo. ¡Casi 5.000 asistentes, 70 gigas de conexión y un ambientazo increíble!

Aquí tenéis todos los vídeos que he publicado. Dale al play y disfruta desde casa 🎧

📅 Domingo 26 de julio

▶️ Euskal Encounter 34, El paseo (y mirando PC´s) -versión corregida

▶️ Euskal 34 Domingo en la mañana

▶️ 260725 Euskal 34 Sábado tarde

📅 Sábado 25 de julio

▶️ Preparación pre Euskal Encounter 34

▶️ Euskal 34 Mañana de Sábado

▶️ 2607024 Euskal Vienes noche - Charla con Dioxcorp

▶️ Euskal 34

📅 Viernes 24 de julio

▶️ Directo Euskal Encounter- primera pruebas

▶️ Entrenamiento PRE EUSKAL ENCOUNTER


🔗 Enlaces de interés


📱 Promoción Simyo

Patrocinado por Simyo — la operadora que te da lo que necesitas sin pagar de más.

🛒 Ir a Simyo

¡Gracias por vuestro apoyo! 🙌

22/7/26

Planes para OpenClaw: ¿qué me interesa?

Después de revisar mis consumos reales del último mes con DeepSeek y comparar las alternativas de suscripción que hay en el mercado, he llegado a algunas conclusiones que creo que pueden servir a cualquiera que use OpenClaw como asistente diario con automatizaciones.

Aquí van los datos, la letra pequeña y las cuentas.

Mi punto de partida: ¿cuánto consumo?

Uso OpenClaw a diario, con deepseek-v4-flash como modelo principal. Estos son mis números reales de los últimos 30 días (23 junio – 22 julio 2026):

  • Coste total: 5,37 USD
  • Requests: ~260 al día / 7.809 al mes
  • Tokens de entrada: 443 millones al mes (el 95% son cache hits, que DeepSeek cobra a solo 0,0028 USD por millón de tokens)
  • Tokens de salida: ~3 millones al mes
  • Modelos usados: 97% deepseek-v4-flash, 3% deepseek-v4-pro

La clave del bajo coste: los cache hits. Como OpenClaw reutiliza el contexto de conversación, 420 de los 443 millones de tokens de entrada mensuales son caché. DeepSeek los cobra prácticamente regalados. Sin ese descuento, cualquier otra plataforma saldría bastante más cara.

Pero 5,37 USD es un coste variable. Me interesa saber si hay algún plan de suscripción que me dé facturación fija, acceso a más modelos y libertad para automatizar. Así que analicé dos opciones: Qwen Token Plan y Ollama Cloud.

1. Qwen Token Plan: la letra pequeña que lo cambia todo

QwenCloud ofrece un plan Lite por 6 USD/mes que, sobre el papel, suena muy bien: modelos como qwen3.8-max, deepseek-v4-pro, generación de imágenes con wan2.7 y vídeo con happyhorse. Todo por un precio fijo.

Pero al leer la documentación oficial aparecen tres problemas:

Problema 1: los créditos del plan de 6 USD no alcanzan

El plan de 6 USD es el Lite (no el Standard, que cuesta 18 USD en oferta). Sus límites:

  • 700 créditos cada 5 horas
  • 2.500 créditos cada 7 días

Según el ejemplo oficial de consumo de Qwen, una llamada de ~50.000 tokens al modelo qwen3.6-plus consume unos 3,18 créditos. Aplicando esa misma proporción a mis números:

  • Consumo diario estimado: ~554 créditos
  • Consumo semanal: ~3.878 créditos

El límite semanal del plan Lite es de 2.500 créditos. A mitad de semana me quedaría bloqueado. El plan de 6 USD no me sirve.

El plan Standard (18 USD) sí alcanzaría (10.000 créditos/semana), pero ya cuesta más del triple que DeepSeek.

Problema 2: la cláusula anti-automatización

Los términos de uso de Qwen dicen textualmente:

"No API automation: Use is limited to interactive use within programming and agent tools (such as Claude Code, Cursor, Qwen Code, Qoder, Qoder CN, OpenClaw, etc.). Using the API Key for automated scripts, application backends, or non-interactive batch processing is prohibited and may result in subscription suspension or API Key revocation."

Esto es un problema serio para mí. Estas son las automatizaciones que tengo funcionando en OpenClaw:

  • Boletín de noticias IA diario (7:15 AM) — genera guion desde NewsAPI, locuta con Azure TTS, publica en redes
  • Eventos del día (8:00 AM) — consulta Google Calendar y me avisa por Telegram
  • Revisión de Gmail — busca donaciones, nóminas, facturas
  • Actualización de hojas de cálculo — donaciones, gastos
  • Heartbeats periódicos — el asistente revisa correo, calendario y tareas cada pocas horas

Son entre 5 y 8 tareas automatizadas al día, más heartbeats. Con la cláusula de Qwen, todo esto está en zona gris como mínimo, y en violación directa como máximo. No me la juego a que me bloqueen la cuenta a mitad de mes.

Problema 3: el modelo flash de DeepSeek no está en Qwen

El plan de Qwen incluye deepseek-v4-pro, pero no incluye deepseek-v4-flash, que es el modelo que uso el 97% del tiempo. Sí incluye qwen3.6-flash como alternativa, pero no es el mismo modelo y la calidad puede variar.

Conclusión sobre Qwen: descartado como proveedor principal. La combinación de créditos insuficientes en el plan de 6 USD + cláusula anti-automatización lo hace inviable para mi caso de uso.

2. Ollama Cloud: la opción sólida

Ollama Cloud es el servicio de inferencia gestionada de Ollama. A diferencia de Qwen, no tiene restricciones de automatización y promociona abiertamente los casos de uso con agentes. Los planes son:

PlanPrecioUso cloudModelos concurrentes
Free0 USDLigero (experimentar)1
Pro20 USD/mes (16,67 si anual)50× Free3
Max100 USD/mes250× Free10

Puntos a favor:

  • OpenClaw está soportado nativamente. La propia homepage de Ollama dice: "Run any app or agent with open models. Get up and running with OpenClaw, Claude Code, and more".
  • Sin restricciones de automatización. Sus términos de servicio no prohíben scripts ni agentes autónomos. Al contrario, el plan Pro se anuncia para "coding automation" y el Max para "continuous agent tasks".
  • Modelos disponibles: deepseek-v4-flash, deepseek-v4-pro, nemotron-3-ultra, qwen3.5 (familia completa), kimi-k2.6/2.7, glm-5.1/5.2, gpt-oss:20b/120b, gemma4, mistral-large-3 y más.
  • deepseek-v4-flash está incluido. Podría usar exactamente el mismo modelo que ahora.
  • Privacidad: "Prompt or response data is never logged or trained on." Infraestructura en NVIDIA Cloud Providers con política de cero retención de datos.
  • API OpenAI-compatible: funciona igual que Ollama local, sin cambiar código.

¿Me conviene económicamente?

El plan que necesitaría es el Pro (20 USD/mes), porque el Free es solo para experimentar. Comparado con DeepSeek:

  • DeepSeek pay-as-you-go: 5,37 USD/mes
  • Ollama Pro: 20 USD/mes (16,67 si facturación anual)

Son ~15 USD más al mes. ¿Qué gano a cambio?

  • Facturación fija predecible
  • Acceso a +15 modelos que DeepSeek no ofrece (qwen, kimi, gpt-oss, gemma, mistral...)
  • Privacidad reforzada (infraestructura USA, no China)
  • Cero riesgo de que me bloqueen por automatizar

¿Me conviene? Depende de cuánto valore la predictibilidad y la libertad de automatización. Si DeepSeek sigue funcionando bien sin sorpresas, la diferencia de 15 USD/mes no se justifica solo por el ahorro. Pero si algún día DeepSeek cambia sus precios de caché o mete restricciones, Ollama Pro es la alternativa más sólida.

3. Si tuviera Ollama Cloud Pro: ¿qué más podría hacer?

Una de las ventajas del plan Pro es que permite 3 modelos concurrentes. Esto significa que podría tener OpenClaw usando un modelo mientras otra herramienta usa otro, sin hacer cola. Por ejemplo, OpenCode (el asistente de código en VS Code).

Simulación de uso combinado: OpenClaw + OpenCode

Asumiendo el plan Pro con sus límites (50× el uso del plan Free, 3 modelos concurrentes, medición por GPU time):

HerramientaModeloUso diario estimadoNivel de modelo
OpenClaw (asistente)deepseek-v4-flash~260 req/día (~15M tokens)3-4
OpenCode (código)qwen3-coder o kimi-k2.7-code~50-100 req/día3-4
Uso puntualdeepseek-v4-pro~10 req/día (tareas pesadas)4

Con 3 slots concurrentes, OpenClaw y OpenCode pueden trabajar simultáneamente sin encolarse. Por ejemplo:

  • OpenClaw generando el boletín de noticias a las 7:15 AM
  • Yo en VS Code pidiéndole a OpenCode que refactorice un script en Python
  • Ambos funcionando a la vez, sin esperas

El límite real estaría en el GPU time semanal. Como Ollama no publica cifras exactas de minutos de GPU por plan, la estimación es cualitativa: el plan Pro está diseñado para "day-to-day work, larger models, coding automation, deep research". Mi uso actual (260 req/día con flash) más 50-100 req/día de OpenCode con un modelo coder encajarían en ese perfil.

Si el uso creciera mucho, Ollama permite comprar créditos extra sin cambiar de plan. Y si algún día necesitara 10 modelos concurrentes para pipelines de agentes, el plan Max (100 USD/mes) está ahí.

Lo que no podría hacer con el plan Pro es tener, por ejemplo, 4 o 5 agentes corriendo a la vez. Para eso haría falta el plan Max.

4. ¿Cuánto más podría usar con Ollama Pro? Y otras alternativas

a. Ollama Pro: ¿cuántas veces mi uso actual de DeepSeek?

Ollama no mide el uso por tokens como DeepSeek, sino por tiempo de GPU. Esto hace que la comparación directa no sea exacta, pero podemos hacer una estimación razonable basada en lo que Ollama publica:

  • Plan Free: diseñado para "light usage" — experimentar con modelos, probar cosas. Estimación: ~10-20 requests al día con modelos de nivel 3-4 (como deepseek-v4-flash).
  • Plan Pro: "50x more than Free" — day-to-day work. Estimación: ~500-1.000 requests al día con el mismo tipo de modelos.

Mi uso actual con DeepSeek: ~260 requests al día con deepseek-v4-flash (modelo nivel 3-4 en la escala de Ollama).

Cálculo estimado: mi uso actual representa entre el 26% y el 52% de la capacidad del plan Pro. Dicho al revés: con Ollama Pro podría hacer entre 2 y 4 veces mi uso actual de DeepSeek antes de tocar el límite.

Traducido a cosas concretas, con el plan Pro de 20 USD podría:

  • Seguir usando OpenClaw exactamente igual que ahora (~260 req/día)
  • Y además usar OpenCode con un modelo como qwen3.5-coder o kimi-k2.7-code para ~100-150 req/día de programación
  • Y además ejecutar un agente tipo Hermes para tareas de investigación o automatización (~50 req/día)
  • Y aún me sobraría margen para picos puntuales de uso

Si algún día mi uso se disparara (por ejemplo, pipelines de agentes pesados), Ollama permite comprar créditos extra sin cambiar de plan. Y como último recurso, el plan Max (100 USD/mes, 250x Free) cubriría prácticamente cualquier carga de trabajo que pueda imaginar.

Resumen: Ollama Pro a 20 USD me da aproximadamente 2-4 veces mi uso actual de DeepSeek. No es que 20 USD "compren más tokens" que 5,37 USD — es que me dan más capacidad total y además acceso a modelos que DeepSeek no tiene, facturación fija, y cero restricciones de automatización.

b. Otras alternativas de suscripción compatibles con OpenClaw

He investigado qué otras plataformas ofrecen planes de suscripción (no pay-as-you-go) que funcionen con OpenClaw:

GLM Coding Plan (Z.ai / Zhipu AI)

PlanPrecioLímites
Lite18 USD/mes (12,60 con 30% dto.)~80 prompts/5h, ~400/semana
Pro72 USD/mes (50,40 con dto.)~400 prompts/5h, ~2.000/semana
Max160 USD/mes (112 con dto.)~1.600 prompts/5h, ~8.000/semana

Modelos incluidos: glm-5.2 (flagship), glm-5-turbo, glm-4.7, glm-4.5-air.

¿Compatible con OpenClaw? Sí. Z.ai lo lista entre sus +20 herramientas soportadas y hay guías de configuración. Un usuario en Reddit reportó haber reducido su factura de 90 a 15 USD al migrar de Claude a GLM-5 en OpenClaw.

⚠️ Pero ojo con la letra pequeña:

  • El GLM Coding Plan está restringido a herramientas de coding. La FAQ oficial dice: "Can I use the GLM Coding Plan for production API workloads? No."
  • Los modelos flagship (glm-5.2) consumen 3x más cuota en horas pico (14:00-18:00 UTC+8, que son las 8:00-12:00 en España).
  • Mi uso de OpenClaw no es solo coding: hago boletines de noticias, revisión de correo, calendario, automatizaciones. Eso probablemente no encaja en la definición de "coding tool" de Z.ai.

Veredicto: Técnicamente funciona con OpenClaw, pero su enfoque exclusivo en coding y la restricción de uso lo dejan en una zona gris para mi caso. Descartado por la misma razón que Qwen: la letra pequeña.

Kimi (Moonshot AI)

Kimi no tiene un plan de suscripción con créditos para API. Sus planes de pago (19-199 USD/mes) son para la app de chat (kimi.com), no para uso vía API. La API de Kimi es exclusivamente pay-per-token:

  • K2.6: 0,95 USD / 4,00 USD por M tokens (input/output), con caché a 0,16 USD
  • K3: 3,00 USD / 15,00 USD por M tokens

Existe "Kimi Code" (~19 USD/mes) pero la API se sigue facturando aparte por token. No es un plan flat-rate como Qwen u Ollama.

Veredicto: No es lo que busco. Si algún día sacan un plan de suscripción para API estilo Qwen/Ollama, habrá que revisarlo. Los modelos Kimi son excelentes (K2.6 y K3 son bestias para código), pero de momento no compiten en esta categoría.

Resumen de alternativas

PlataformaPlan desde¿Flat-rate?¿OpenClaw?¿Automatización?¿Para mí?
Ollama Cloud20 USD/mes✅ Sí✅ Nativo✅ Sin restricción✅ Plan B sólido
Qwen Token Plan6 USD/mes✅ Sí✅ Oficial❌ Prohibida❌ Descartado
GLM Coding Plan18 USD/mes✅ Sí✅ Soportado🟡 Solo coding❌ Zona gris
Kimi APIPay/go❌ No✅ Compatible✅ Sin restricción❌ No es suscripción

5. Resumen final

DeepSeek (actual)Qwen Lite (6 USD)Ollama Pro (20 USD)
Coste mensual5,37 USD6 USD20 USD
¿Alcanzan los límites?✅ Pay/go❌ 2.500 créd./sem✅ 50× Free
Automatizaciones✅ Sin restricción❌ Prohibidas✅ Sin restricción
Modelo diariov4-flashqwen3.6-flashv4-flash
Modelos extraSolo DeepSeek+ qwen, wan2.7, happyhorse+15 modelos open
Uso multi-agente✅ (pago por uso)1-2 agentes3 concurrentes

Mi plan: me quedo con DeepSeek como daily driver mientras los cache hits sigan siendo regalados. Si DeepSeek cambia sus condiciones o necesito más modelos, Ollama Pro es el plan B. Qwen, descartado por la letra pequeña. Y mientras tanto, sigo usando Ollama Cloud en su tier gratuito para probar modelos como nemotron-3-ultra de vez en cuando.

¿Tú qué usas? ¿Has probado algún plan de suscripción para tus agentes? Cuéntamelo en los comentarios.

13/7/26

La fusión IA + control del PC

 


OpenAI merece todo el reconocimiento por las integraciones que está haciendo. Integraciones que hacen que OpenClaw se quede pequeño. Ya permitía control del PC y de archivos, pero es que va a más y permite hacer más cosas. Creo que esto pone fin a Hermes y a OpenClaw, ya que dispone de múltiples integraciones, pero esta integración ¡que ya existía! te permite sacar partido a tu hardware y a tu sistema operativo (por ejemplo: abre en el firewall el puerto 89, o actualiza lo que sea) ¡me parece impresionante!
Esto hace que los no expertos podamos hacer cosas que de otra manera serían imposibles:

-montar un servidor doméstico.
-levantar servicios.
-instalar repositorios de Github.
-organizar ficheros y carpetas.
-modificar masivamente hojas de cálculo.
-automatizar copias de seguridad.
-poner en marcha grabación de vídeo/streaming. 
-automatizar TODO: envío de boletines, ejecución de scripts (puerta abierta a TODO).

¿Y la privacidad? Eso nunca ha existido.

En cuanto a proyectos como mis juegos de rol conversaciones, ahora es mucho mejor organizarlos como proyectos (con carpetas y ficheros md para dar consistencia a los mundos y a las conversaciones). Esto hace que ChatGPT versión Web ¡deje de tener sentido!

He estado mirando vídeos y hablando con la misma GPT 5.6 para saber qué diferencia aporta respecto a los modelos anteriores, y eso ha sido entrar en un mundo incierto. Creo que a parte de las mejores "sutiles" en programación, diseño de interfaces, las mayores mejoras vienen de la autonomía continuada, es decir, trabajar durante horas en un proyecto con apenas una instrucción. 

Pensamiento de Conversodamus: Ahora mismo tenemos buscadores web y navegadores web para IA´s. Dentro de poco tendremos a IA´s jugando vídeo juegos para que nosotros miremos. La IA agéntica, la que se pone a cumplir una tarea de forma independiente durante horas, o días ES ya una revolución. No sé en qué va a parar esto. Tampoco no me explico cómo no estamos haciendo ya cosas increíbles, en lugar de juegos estúpidos. Sencillamente nos falta creatividad. La semana pasada vi a un asiático que había creado su propia mochila, con sensores gps, cámaras, y conexión a internet. Se paseaba por un barrio, miraba si los negocios tenían página web, y le mandaba a cada negocio una propuesta de web con una web como sugerencia de lo que su negocio podría ser. ESO ES CREATIVIDAD. 

Ahora mismo yo me siento a pensar eso mismo, ¿qué podría estar haciendo con mi cuota de ChatGPT que pueda ser como mínimo útil?

INTEGRACIÓN CON EL NAVEGADOR, GPT Work tiene un navegador integrado, lo cual me ha resultado muy útil a la hora de llevar a cabo ciertas tareas con la configuración DNS de algún proyecto personal, pero ¡si la IA tiene acceso al navegador podrá hacer muchas más cosas! Ahora hay una extensión de ChatGPT para Chrome/Edge que permite hacer lo que Perplexity permitía: tomar el control de mi navegador y llevar a cabo tareas. De momento le he pedido que analice una partida de Ogame, diseñe estrategias para mejorar mi juego (cosa que ha hecho) ¡y ahora le he pedido que lo haga!

Os recuerdo que tengo a la venta mi Surface Copilot: Vidas en red: A la venta mi Surface Copilot