TL;DR:
- DeepSeek avisó en su documentación para desarrolladores que subirá el precio general de su API, sin publicar monto ni fecha de entrada en vigor.
- Su modelo V4-Flash cobra hoy 0.14 dólares por millón de tokens de entrada y 0.28 por millón de salida, y baja a 0.0028 cuando el texto ya viene en caché.
- El aviso cae a menos de una semana del estreno de V4-Flash-0731 y en plena pelea por el piso de tarifas con Meta y OpenAI.
DeepSeek avisó este jueves 6 de agosto de 2026 que subirá "de forma significativa" el precio general de su API, el canal por el que desarrolladores y empresas conectan sus aplicaciones con los modelos del laboratorio chino. La advertencia, publicada en la página de precios de su documentación técnica y reportada por Bloomberg, llegó sin monto, sin fecha de arranque y sin una razón. La compañía, con sede en Hangzhou, pidió a sus clientes planear su consumo con eso en mente y adelantó que el esquema definitivo se comunicará por separado. El aviso aparece a menos de una semana de que estrenara DeepSeek-V4-Flash-0731, el modelo que volvió a colocarla como la opción más barata del mercado. Para los equipos que la eligieron por precio, el presupuesto del próximo trimestre se quedó sin números.
El momento es lo que llama la atención. El 31 de julio DeepSeek liberó esa nueva versión de Flash con mejor desempeño en tareas de agente y programación, y la dejó con el mismo rate card de antes. Seis días después, la misma página que lista esas tarifas anuncia que van a subir. No hay porcentaje, no hay calendario y tampoco un desglose de qué modelos o qué rubros de facturación tocará el ajuste.
En el gremio la reacción fue inmediata. El desarrollador Michael Guo lo puso en X con una pregunta que resume el ánimo, según recogió el South China Morning Post:
"Que DeepSeek elija subir precios en este momento, ¿no es buscarse problemas?"
Su argumento: los modelos nuevos de Meta y OpenAI ya compiten con DeepSeek tanto en capacidad como en tarifa.
Lo que cuesta hoy y el rubro donde más dolería el ajuste
Mientras no salga la notificación oficial, el rate card publicado sigue siendo el único dato firme. Estos son los precios vigentes por millón de tokens, según la documentación de la propia empresa:
- V4-Flash: 0.14 dólares de entrada sin caché, 0.0028 con caché y 0.28 de salida.
- V4-Pro: 0.435 de entrada sin caché, 0.003625 con caché y 0.87 de salida.
- Los dos con ventana de 1 millón de tokens, salida máxima de 384K y límites de concurrencia de 2,500 y 500 peticiones.
Ahí está el detalle que casi nadie mira: el arma real de DeepSeek no es el precio de entrada, es el de caché. Artificial Analysis coloca ese 0.0028 como el más bajo entre los 101 modelos de su clase, un 98% por debajo de la propia tarifa de entrada del modelo. Cualquier carga de trabajo repetitiva (un prompt de sistema fijo, un documento largo que se reutiliza) vive de esa cifra. Si el ajuste general la toca, el golpe lo sienten primero los proyectos de alto volumen, no los de consultas sueltas.
Hay un segundo factor que suele quedar fuera de la cuenta. V4-Flash razona antes de responder y, en las mediciones de Artificial Analysis, gastó 210 millones de tokens de salida para completar su Intelligence Index, frente a una mediana de 100 millones. Es barato por token y hablador por diseño, así que el precio de salida pesa doble en la factura final. Correr esa batería completa costó 72.02 dólares con las tarifas actuales.

El recargo por horas pico cae en plena mañana española
DeepSeek tiene dos cambios de precio pendientes al mismo tiempo, y conviene no confundirlos. En julio anunció una política de tarifas pico y valle que duplica el costo de todos los rubros de facturación durante dos franjas diarias de Pekín, de 9:00 a 12:00 y de 14:00 a 18:00. Su documentación dice que la fecha de arranque se avisará después, y esa fecha sigue sin publicarse.
Traducido al reloj del lector hispanohablante, ese recargo no reparte el daño por igual. Las franjas de Pekín equivalen a las 3:00 y a las 8:00 de la mañana en España, es decir, el segundo bloque cubre media jornada laboral en Madrid. En Ciudad de México caen entre las 7:00 de la noche y las 4:00 de la madrugada, fuera del horario de oficina. Un equipo español que dispare trabajos batch a media mañana estaría pagando doble; uno mexicano, con programar la corrida de madrugada, se libra.
El piso de precios dejó de ser suyo hace una semana
La ventaja que DeepSeek defendió durante año y medio se le movió del suelo. El 30 de julio OpenAI recortó GPT-5.6 Luna a 0.20 dólares de entrada y 1.20 de salida por millón. Y Meta lanzó Muse Code con dos niveles: el estándar a 1.25 y 4.25, y otro a 0.10 y 0.20 para quien acepte que sus datos entrenen al agente, según las cifras del Wall Street Journal citadas por el analista M.G. Siegler. Por token, ese nivel de Meta ya cobra menos que V4-Flash.

Por tarea completa, sin embargo, la distancia todavía es enorme. Los cálculos de Artificial Analysis que reprodujo Investing.com ponen a V4-Flash en unos 0.03 dólares por tarea de referencia, contra 0.86 del Kimi K3 de Moonshot AI, 1.86 del GPT-5.6 Sol de OpenAI y 3.15 del Claude Fable 5 de Anthropic. Ahí está la tensión completa de la noticia: DeepSeek sigue ganando por goleada en costo por trabajo terminado, y aun así avisa que necesita cobrar más.
Lo que DeepSeek no puso por escrito
La empresa no dio motivo. El South China Morning Post enmarca el aviso en la demanda global que despertó el modelo nuevo, y la explicación circula entre desarrolladores, pero no hay confirmación oficial de que la saturación de cómputo sea la causa. Tampoco se sabe si el alza aplicará parejo a Flash y Pro, ni qué pasará con el precio de caché.
El contexto financiero suma otra capa. The Information reportó que DeepSeek reanudó su segunda ronda de financiamiento, pausada más de una semana tras filtrarse la transcripción de una llamada confidencial entre el fundador Liang Wenfeng y sus inversionistas, y que esta semana circuló un nuevo term sheet entre ellos. Subir tarifas mientras se levanta capital no es una coincidencia rara en esta industria.
Queda una salida para quien haya construido encima. El ajuste solo alcanza al servicio de API alojado por DeepSeek: los pesos de V4-Flash-0731 están bajo licencia MIT, se pueden descargar y correr en infraestructura propia, y Artificial Analysis lista seis proveedores externos que ya lo sirven. Es la misma apuesta por los modelos abiertos que hoy discuten Washington y Pekín, solo que aplicada a una hoja de cálculo.
Preguntas rápidas sobre el alza de precios de DeepSeek
¿Cuánto va a subir DeepSeek sus precios?
La empresa no publicó ni porcentaje ni fecha. Su aviso del 6 de agosto de 2026 solo describe el aumento como significativo y remite a una notificación oficial posterior con el esquema definitivo. Mientras tanto siguen vigentes las tarifas actuales: 0.14 dólares de entrada y 0.28 de salida por millón de tokens en V4-Flash.
¿El aumento afecta a quien descarga el modelo?
No. El ajuste alcanza al servicio de API que opera DeepSeek. Los pesos de DeepSeek-V4-Flash-0731 se distribuyen bajo licencia MIT, que permite uso comercial, así que quien lo ejecuta en su propia infraestructura fija su costo por hardware. Artificial Analysis registra seis proveedores de API además del propio DeepSeek.
¿Es lo mismo que el recargo por horas pico de julio?
No, son dos medidas distintas. El recargo anunciado en julio duplica todos los rubros de facturación durante dos franjas horarias de Pekín, de 9:00 a 12:00 y de 14:00 a 18:00, y su fecha de arranque tampoco se ha publicado. El alza avisada el 6 de agosto es general y llegará con su propio comunicado.
DeepSeek construyó su reputación global sobre una idea sencilla: que la inteligencia artificial de primer nivel podía costar centavos. El aviso de este jueves no la desmiente, porque sus modelos siguen siendo los más baratos por tarea de toda la tabla, pero sí pone a prueba cuánto de su clientela se quedó por lealtad y cuánto por la factura. La respuesta llegará el día que publique los números nuevos.