Saltar al contenido

DeepSeek lanzó V4-Pro con el precio más bajo del mercado y el domingo lo sube hasta 12 veces

DeepSeek puso su modelo insignia en disponibilidad general sin blog ni reporte técnico. El 16 de agosto a las 16:00 UTC entra una tarifa doble por horario: la salida de V4-Pro pasa de 0.87 a 3.96 dólares en la franja cara y el caché se multiplica por doce.

por Alejandro Castillo Leone
Hands typing on a laptop with code on screen, smartphone nearby at night, indoor setting.
Foto de Adventure Studio en Pexels

TL;DR:

  • DeepSeek puso su modelo insignia DeepSeek-V4-Pro-0813 en disponibilidad general el 12 de agosto de 2026, sin blog, sin reporte técnico y sin comunicado.
  • Desde las 16:00 UTC del 16 de agosto cobra dos tarifas según la hora: la salida de V4-Pro pasa de 0.87 a 1.98 dólares por millón de tokens fuera de pico y a 3.96 en horario pico.
  • El evaluador independiente Vals AI midió 54.68% en Terminal-Bench 2.1, 33 puntos por debajo del 87.9 que reporta la tabla de la propia empresa.

DeepSeek sacó de vista previa su modelo insignia el 12 de agosto de 2026. DeepSeek-V4-Pro-0813 empezó a servirse en el endpoint deepseek-v4-pro sin blog, sin reporte técnico y sin comunicado: la señal fue un cambio de versión en la página de precios de su API. Lo que circuló ese día fue el costo, 0.435 dólares por millón de tokens de entrada y 0.87 de salida, cuando Claude Fable 5 de Anthropic cobra 50 dólares por esa misma medida. La tarifa dura hasta las 16:00 UTC del domingo 16 de agosto. Desde esa hora la empresa china cobra dos precios según el momento del día y, en la franja cara, un millón de tokens de salida de V4-Pro cuesta 3.96 dólares, 4.5 veces lo de hoy. El caché, la partida que sostiene la economía de los agentes, se multiplica por doce.

La tarifa doble castiga sobre todo al caché

El esquema tiene horario pico y horario económico, con la tarifa barata a la mitad de la cara. DeepSeek fijó el pico entre las 01:00 y las 04:00 UTC y entre las 06:00 y las 10:00 UTC; el resto del día es franja económica. La empresa explicó el cambio como una forma de asignar los recursos de manera más razonable, según recogió Bloomberg, y el objetivo declarado es empujar el trabajo que no corre prisa hacia las horas menos congestionadas.

Así queda la factura por millón de tokens de V4-Pro antes y después del cambio:

Partida Hoy Fuera de pico Pico
Entrada sin caché $0.435 $0.66 $1.32
Entrada desde caché $0.003625 $0.022 $0.044
Salida $0.87 $1.98 $3.96

El ajuste va de un 52% en la entrada más barata hasta más de 1,100% en el caché en hora pico. Ese último renglón es el que duele: hasta ahora un token repetido costaba 120 veces menos que uno nuevo y desde el domingo costará solo 30 veces menos. Para un agente que relee los mismos archivos decenas de veces por tarea, esa partida no es un detalle contable.

V4-Flash, el modelo chico de la casa, recibe el mismo tratamiento: su salida pasa de 0.28 a 1.32 dólares en horario pico. La subida del caché repite además un movimiento que ya se había visto días antes, cuando Grok 4.6 igualó a GPT-5.6 Sol sin tocar su precio por token y con el caché subiendo de 0.30 a 0.50 dólares.

Grok 4.6: mismo precio de lista, caché más caro
Grok 4.6 marca 61 en el índice de Artificial Analysis y conserva la tarifa de 2 y 6 dólares, pero el caché sube de 0.30 a 0.50.

En México la jornada laboral entera cae en la tarifa barata

Las dos franjas caras coinciden con el horario de oficina en China: de 09:00 a 12:00 y de 14:00 a 18:00 en Pekín. Traducido al huso de los lectores hispanohablantes, el mapa cambia bastante según dónde se programe la carga de trabajo.

En Ciudad de México el pico cae entre las 19:00 y las 22:00 y entre la medianoche y las 04:00. En Tijuana, una hora antes. Toda la jornada laboral mexicana queda dentro de la tarifa barata, y quien deje corriendo procesos nocturnos es el que termina pagando doble. En España ocurre lo contrario: con Madrid en UTC+2, el pico abarca de 08:00 a 12:00, justo la mañana de oficina, más una segunda ventana de madrugada entre las 03:00 y las 06:00.

El cambio entra en vigor a las 10:00 del domingo en Ciudad de México, a las 09:00 en Tijuana y a las 18:00 en Madrid. En Pekín son las 00:00 del lunes 17, y por eso parte de la cobertura fechó el ajuste un día después.

Woman working on cybersecurity programming with laptops and multiple screens
Imagen ilustrativa: el nuevo esquema de precios premia mover las cargas de trabajo a las horas de menor demanda en China. · Foto de cottonbro studio en Pexels

El contexto financiero ayuda a leer el movimiento. Bloomberg reportó que DeepSeek está en medio de una ronda de financiamiento grande y ya empezó a preparar una salida a bolsa que podría llegar este mismo año, con Liang Wenfeng, su fundador, obligado por primera vez a equilibrar las expectativas de los inversionistas con el costo de construir infraestructura de cómputo. La compañía había avisado el 6 de agosto que subiría precios, sin dar cifras ni fecha.

La tabla de benchmarks pasó por WeChat, Reddit y Hacker News

El lanzamiento no trajo página de anuncio. El desarrollador Simon Willison, que documenta los estrenos de modelos, tuvo que enlazar a OpenRouter porque no encontró ninguna publicación oficial, y describió el recorrido de las cifras: salieron al grupo oficial de DeepSeek en WeChat, alguien las copió en un post de Reddit que los moderadores borraron por poco elaborado y de ahí terminaron en una tabla de arte ASCII en Hacker News. El South China Morning Post reportó que la breve declaración que sí apareció en el sitio oficial el miércoles había desaparecido para la tarde del jueves.

Las cifras de esa tabla son grandes. Frente al preview de abril, DeepSWE sube de 12.8 a 62.7, Terminal Bench 2.1 de 72.1 a 87.9, CyberGym de 52.7 a 83.3 y AutomationBench de 12.8 a 31.8. Todas comparan el modelo nuevo contra la versión previa de la propia empresa, no contra un rival.

Los índices independientes dibujan otro cuadro. En el Artificial Analysis Intelligence Index, V4-Pro sube de 45 a 53 y empata con GLM-5.2 de Zhipu, cuatro puntos por debajo del GPT-5.6 Terra de OpenAI y siete por debajo de Kimi K3 de Moonshot. Vals AI, la firma de San Francisco que corre sus propias evaluaciones, lo colocó en el puesto 12 de su índice con 66.25%, más de diez puntos por encima de la versión anterior.

El choque más duro está en un solo renglón. Vals corrió Terminal-Bench 2.1 tres veces completas y obtuvo 54.68%, puesto 33 de 52 modelos, con 28.89% en las tareas difíciles. DeepSeek reporta 87.9 en esa misma prueba. Son 33 puntos de diferencia en el número que la empresa usó como titular de su tabla. El otro punto flojo que detectó Vals fue el modelado financiero en Excel, con 52.80% y el puesto 24 de 37.

Donde sí destacó, y con cuánto ruido

La misma evaluación trae el resultado que a DeepSeek le sirve más. En SWE-bench Verified, V4-Pro quedó segundo entre 82 modelos con 96.40%, el mejor de todos los de peso abierto, por delante de Kimi K3 y a menos de un punto de Claude Opus 5. Y lo hizo a 0.02 dólares por prueba frente a los 1.29 dólares que costó Opus 5.

La firma belga de seguridad Aikido probó el modelo en su banco de vulnerabilidades y llegó a un resultado parecido. El investigador Philippe Dourassov publicó que V4-Pro redescubrió el 87.5% de los CVE del ejercicio a la tercera pasada, por encima del 81.3% de Claude Opus 5 y Qwen 3.8, pero que solo el 65.6% de lo que reportó era una vulnerabilidad real, muy lejos del 86.4% de GPT-5.6 Sol. Dourassov lo describió como un modelo potente para encontrar fallas profundas y poco fiable para una auditoría exhaustiva.

Queda un pendiente que afecta a cualquiera que evalúe alojar el modelo por su cuenta: los pesos del build 0813 no se han publicado. El repositorio de DeepSeek en Hugging Face sigue mostrando la versión preview de abril, así que quien hoy corre V4-Pro en infraestructura propia no está corriendo el mismo modelo que responde en la API.

Fuentes: 1, 2, 3, 4, 5

Alejandro Castillo Leone imagen de perfil
por Alejandro Castillo Leone

Soy un amante del arte y la cultura. Desde el 2021 dirijo una web dedicada a la historia de mi país y he emprendido la misión de vivir para la cultura, alimentándome principalmente del ámbito Hispanoamericano.

Suscríbete GRATIS

Recibe las noticias más importantes de política, tecnología, negocios, deportes, entretenimiento y cultura directamente en tu correo.

¡Listo! Revisa tu correo

Para completar la suscripción, haz clic en el enlace de confirmación que enviamos a tu correo. Si no llega en 3 minutos, revisa tu carpeta de spam.

Ok, gracias

Leer más de Tecnología y Ciencia