
El domingo 16 de agosto, DeepSeek sustituirá su tarifa plana por token de la API por una facturación punta y valle, el primer recargo por franja horaria que introduce un laboratorio chino de IA y un giro brusco para la empresa que construyó su reputación global haciendo casi gratuita la inteligencia cercana a la frontera. Las nuevas tarifas, publicadas en la página oficial de precios de DeepSeek, suben los precios en todos los modelos y en todas las partidas. En el extremo, la tasa de entrada con acierto de caché de V4-Pro en hora punta pasa de 0,003625 a 0,044 dólares por millón de tokens, un aumento de doce veces que Quartz ha resumido en hasta un 1.100 por ciento. Para cargas de trabajo mixtas típicas, el aumento se sitúa más cerca de dos a cuatro veces, e incluso las horas valle con descuento cuestan más que las tarifas planas actuales.
La estructura importa tanto como las cifras. Las horas punta son de 01:00 a 04:00 y de 06:00 a 10:00 UTC, es decir, la jornada laboral de Pekín: de 09:00 a 12:00 y de 14:00 a 18:00. Las tarifas valle son la mitad de las punta, así que el calendario se lee como un esquema de racionamiento de la demanda al estilo de los precios dinámicos de las aplicaciones de transporte aplicado a los tokens. Los tokens de entrada (sin acierto de caché) suben de 1,5 a 3 veces según el modelo y la ventana, los de salida de 2,3 a 4,7 veces, y las tasas de acierto de caché que convirtieron a DeepSeek en la opción por defecto para cargas de trabajo intensivas en recuperación y agénticas suben de 2,5 a 6 veces en valle y de 5 a 12 veces en punta.
La subida llega menos de tres meses después de que DeepSeek hiciera permanente un recorte del 75 por ciento en el precio de V4-Pro, continuación a su vez de la campaña iniciada a principios de 2025, cuando el lanzamiento de su línea de modelos V3 borró cientos de miles de millones de dólares de las acciones tecnológicas estadounidenses en una sola sesión y arrastró a Alibaba, Zhipu y MiniMax a una guerra de precios. V4-Flash y V4-Pro se lanzaron en abril con 0,14 dólares de entrada y 0,28 de salida, y 0,435 de entrada y 0,87 de salida, por millón de tokens; los alias heredados deepseek-chat y deepseek-reasoner se retiraron el 24 de julio, y el recargo punta se anunció por primera vez el 30 de junio con una entrada en vigor prevista para mediados de julio. La versión publicada para el 16 de agosto es más agresiva que aquel primer anuncio: la versión de junio prometía que los precios fuera de las horas punta se mantendrían, mientras que el calendario final también sube las tarifas valle.
El lugar que DeepSeek ocupe en el mercado tras el cambio depende por completo del reloj. En valle, V4-Flash, con 0,22 dólares de entrada y 0,66 de salida por millón de tokens, sigue siendo el modelo de contexto de 1 millón de tokens más barato con capacidad cercana a la frontera, unas 20 a 45 veces más barato que el buque insignia de OpenAI, GPT-5.6 Sol, que cobra 5 dólares por millón de tokens de entrada y 30 por millón de tokens de salida, y aún más lejos de Claude Fable 5, con 10 y 50 dólares por millón de tokens, respectivamente. En punta, el suelo desaparece: la salida de Flash a 1,32 dólares cuesta más que los 1,20 de MiniMax M3, varias veces los 0,20 de Qwen Turbo, y se sitúa en la misma banda que los modelos occidentales de gama media. V4-Pro en punta, con 1,32 de entrada y 3,96 de salida, ya no es un buque insignia económico; es un producto de mercado medio que compite con Gemini 3 Flash y el nivel más barato de GPT-5.
La geografía de las ventanas punta determina quién absorbe la subida. Para África occidental y central, la ventana de 06:00 a 10:00 UTC cubre la mañana laboral de 07:00 a 11:00, de Acra a Lagos y Johannesburgo. África oriental es similar: la mañana laboral de Nairobi, de 09:00 a 13:00, es punta. El sur y el sureste asiático lo tienen peor: Delhi, Daca, Yakarta y Manila tienen ambas ventanas punta dentro de la jornada laboral, así que el recargo se aplica durante gran parte del tiempo en que los desarrolladores están realmente construyendo. La mañana europea también tributa. América Latina es la excepción: ambas ventanas caen en horario vespertino y nocturno en São Paulo, Ciudad de México y Buenos Aires, lo que da a la región precios valle durante toda su jornada laboral, y las horas de trabajo de Norteamérica también son valle. Un calendario de precios calibrado según el reloj de Pekín grava de hecho el uso diurno en las mismas regiones donde los bajos precios de DeepSeek tuvieron el efecto más democratizador.
Las consecuencias para los mercados emergentes son concretas. Las startups de edtech, fintech, healthtech y agritech de África y Asia construyeron sistemas de producción asumiendo que los precios de los tokens seguirían bajando; un aumento de dos a cuatro veces, con tasas de acierto de caché hasta seis veces superiores o más para cargas agénticas, erosiona márgenes que ya eran reducidos. La carga se amplifica por la moneda: las facturas de la API se denominan en dólares mientras los ingresos llegan en nairas, chelines, rupias y rupias indonesias, monedas que han perdido terreno frente al dólar, así que el aumento efectivo en moneda local es más pronunciado de lo que sugiere la cifra en dólares.
La migración es la respuesta probable. Qwen Turbo, de Alibaba, cuesta una fracción de lo que costará DeepSeek tras la subida en tareas sencillas y lleva un contexto de 1 millón de tokens; MiniMax M3 es de pesos abiertos, más barato en salida que Flash en punta y también abarca 1 millón de tokens; Kimi y GLM están cerca. Los desarrolladores que llegaron a DeepSeek a través de agregadores como OpenRouter verán la subida repercutida también allí. Para cargas de alto volumen, los pesos de la vista previa de V4 de abril siguen abiertos, lo que convierte el alojamiento propio en la salida racional para quienes puedan conseguir GPU, pero en la mayoría de los mercados emergentes la computación es escasa, cara y a menudo sujeta a restricciones de importación, así que el alojamiento propio es un lujo más que una opción por defecto.
La subida también mueve el suelo de precios de todo el segmento. DeepSeek definió cuánto costaban los tokens baratos cercanos a la frontera, y su nuevo suelo de 0,22 dólares de entrada y 0,66 de salida por millón de tokens reajusta las expectativas de todo comprador sensible al precio y da a los competidores margen de maniobra. The Next Web señaló que los rivales pueden ahora cortejar a los desarrolladores con promesas de tarifa plana; el primero en moverse puede ser Alibaba, que tiene la escala y el ecosistema de pesos abiertos para absorber la demanda sensible al precio en toda Asia y África. La ventana competitiva es lo bastante real como para que Microsoft, de la que Bloomberg informó en marzo que impulsaba su propia campaña de adopción en África explícitamente como desafío a DeepSeek, tenga un discurso de venta más fácil después del domingo.
La lectura estratégica es la capacidad. DeepSeek es la víctima más visible de la escasez de cómputo del sector: la escasez de memoria ha encarecido los precios de las GPU en la nube, con Amazon subiendo tarifas en plena presión, y una empresa que prometió tokens casi gratuitos ha reconocido que los chips que hay debajo no lo son. La compañía ha dicho a los desarrolladores que la subida refleja el aumento de los costes de cómputo, los cuellos de botella de capacidad y el tráfico récord; su modelo V4-Flash escaló a lo más alto de los rankings mundiales de uso de tokens en OpenRouter y Ollama, acumulando billones de tokens, y Bloomberg ha informado de planes para un centro de datos de 1 gigavatio en Mongolia Interior. DeepSeek tampoco está sola: Zhipu subió los precios de la API un 83 por ciento interanual en el primer trimestre, y Moonshot y ByteDance han añadido niveles de pago o pausado los registros para gestionar la capacidad, una retirada más amplia de la guerra de precios que iniciaron los laboratorios chinos. La fijación de precios por franjas horarias desplaza la carga a las horas tranquilas, y las horas tranquilas resultan ser la jornada laboral de América Latina y Norteamérica. El recargo llega además con un incentivo inusual: los debates en Hacker News señalan que DeepSeek está instando a los usuarios a aumentar su uso durante los próximos dos o tres meses, lo que sugiere que se avecinan nuevos modelos y que el calendario del 16 de agosto puede ser tanto un puente hacia una línea de productos con nuevos precios como un cambio aislado.
Nada de esto hace que DeepSeek sea caro en términos absolutos. En valle, sigue siendo un orden de magnitud más barato que los buques insignia occidentales; la aplicación de consumo sigue siendo gratuita; y la cifra extrema de 12 veces es un caso límite más que la factura típica. Pero la empresa que convirtió los precios planos y a la baja de la IA en la referencia para los desarrolladores más sensibles al precio del mundo les ha puesto ahora un suelo y un techo. Las regiones que más se beneficiaron de esa referencia, África y la mayor parte de Asia, son las que tienen sus horas de trabajo dentro de las nuevas ventanas de recargo. El resultado probable es una migración silenciosa hacia Qwen, MiniMax y los pesos abiertos, un argumento más fuerte para la infraestructura de IA local y soberana, y una versión más pequeña de la historia de la IA asequible en los mercados donde fue más real.
Traducido por Alessandra
Sources: Models & Pricing (DeepSeek API Docs, official rate card, Aug 2026); DeepSeek raises API pricing for its V4 models (Reuters, Aug 13, 2026); DeepSeek raising API prices by up to 1,100% starting Aug. 16 (Quartz, Aug 13, 2026); DeepSeek breaks China’s AI price war with peak-hour surge pricing (The Next Web, Jul 1, 2026); DeepSeek Prepares Significant Price Hike (Android Headlines, Aug 6, 2026); DeepSeek API Pricing (BenchLM, Aug 2026); LLM API Pricing Comparison (BuildMVPFast, Jul 2026); Microsoft pushes for Africa AI adoption in challenge to DeepSeek (Bloomberg, Mar 2026); DeepSeek announced to raise its API price tremendously (Hacker News, Aug 2026)

