DeepSeek cuadruplica sus precios de API y refuerza la tesis de gasto en infraestructura
Andrés Valcárcel · Económicas · 2026-08-20
El desarrollador chino subió tarifas hasta 355% el domingo pasado tras avisar que los costos de computación eran insostenibles. La brecha con OpenAI se achica, pero DeepSeek sigue siendo cinco veces más barato mientras confirma que entrenar y servir modelos frontera a escala cuesta.
DeepSeek implementó el domingo 16 de agosto a las 16:00 UTC un cambio de precios que cuadruplica la tarifa de sus dos modelos estrella. El V4-Pro pasó de USD 0,87 a USD 3,96 por millón de tokens en horario pico (aumento del 355%), mientras el V4-Flash saltó de USD 0,28 a USD 1,32 (371% más). La compañía china había adelantado el jueves 6 de agosto que los precios subirían «significativamente» a corto plazo, sin especificar fecha ni magnitud.
El ajuste marca el fin de una era: desde que DeepSeek lanzó su modelo R1 en enero de 2025 a aproximadamente USD 0,14 por millón de tokens, contra USD 7,50 que cobraba OpenAI por un servicio comparable (una diferencia del 98%), los inversores cuestionaron si las principales empresas de IA estadounidenses estaban sobregastando en infraestructura que un rival había igualado por una fracción del costo. Ese cuestionamiento desencadenó una venta masiva en acciones tecnológicas y presionó las valoraciones del ecosistema durante meses.
La demanda fuerza el giro
Los datos de OpenRouter de la semana del 28 de julio al 3 de agosto muestran que los modelos chinos procesaron 28,13 billones de tokens, frente a solo 4,38 billones para los modelos estadounidenses. Fue la decimocuarta semana consecutiva en la que los modelos chinos lideraron el uso global, con DeepSeek como uno de los principales motores de ese volumen. Servir ese tráfico a USD 0,14 por millón de tokens no cubre los costos de entrenar modelos frontera que requieren cientos de millones de dólares ni la infraestructura de inferencia a escala.
El timing del cambio de precios coincide con los planes de DeepSeek para un centro de datos de IA de 1 GW en Ulanqab, Mongolia Interior, parcialmente esperado en línea a finales de 2027 o principios de 2028. El CEO de Nvidia, Jensen Huang, estimó que equipar ese proyecto con aceleradores de última generación costaría aproximadamente USD 50.000 millones. DeepSeek cerró en junio de 2026 una ronda de financiación inicial de más de USD 7.400 millones con valoración superior a USD 50.000 millones, con Tencent y CATL entre los inversores; una segunda ronda buscando casi USD 8.000 millones fue reportada en agosto.
Implicación para Nvidia y los hiperescaladores
El cambio de precios de DeepSeek debilita el caso bajista que pesaba sobre Nvidia (NASDAQ:NVDA) desde enero de 2025: si el aumento de uso está presionando a proveedores de modelos a cobrar más porque los costos de computación siguen siendo significativos, la demanda de chips para centros de datos no desaparecerá con modelos más eficientes. Nvidia cotiza hoy a USD 217,31 (-0,12%), en un rango diario de USD 216,76 a USD 222,87, y reportará ganancias el miércoles 26 de agosto.
- Microsoft (MSFT) cotiza a USD 482,27 (-0,42%): sus negocios en la nube pueden seguir beneficiándose si los clientes ejecutan modelos de terceros o de peso abierto en Azure, incluso cuando la competencia entre desarrolladores de modelos comprime márgenes.
- Amazon (AMZN) opera a USD 261,29 (-1,71%): el argumento es similar para AWS, donde el crecimiento de 37% récord publicado recientemente se apoya en demanda de infraestructura para inferencia y entrenamiento.
- Alibaba (BABA) sube 0,71% a USD 129,82: la compañía china compite con DeepSeek en el mercado local de modelos, y el aumento de precios del rival señala que el dumping de precios no es sostenible a largo plazo.
Incluso después de los aumentos, DeepSeek mantiene una brecha de precio amplia: su tarifa pico de USD 3,96 por millón de tokens de salida para el V4-Pro sigue siendo 87% más barata que los USD 30 de salida de OpenAI para GPT-5.6 Sol y 84% más barata que los USD 25 de salida de Anthropic para Claude Opus 5. Las tarifas fuera de pico son la mitad de las del horario pico, lo que preserva el atractivo de bajo costo de DeepSeek para desarrolladores con flexibilidad horaria.
El fin del dumping como estrategia
El aumento de precio importa porque los modelos chinos baratos habían presionado la suposición de que las principales empresas de IA pueden mantener indefinidamente precios premium. Entrenar modelos frontera cuesta cientos de millones de dólares; servir inferencia a USD 0,14 por millón de tokens no cubre esos costos a escala, y los inversores lo saben. DeepSeek implícitamente lo confirma al subir precios justo cuando anuncia un centro de datos de USD 50.000 millones.
El horario pico que introdujo DeepSeek (de 01:00 a 04:00 UTC y de 06:00 a 10:00 UTC) refleja la geografía de la demanda: esas franjas coinciden con el día laboral en Asia y el inicio de la jornada en Europa. La diferenciación horaria permite a DeepSeek capturar más margen cuando la demanda es inelástica, sin perder competitividad fuera de esos tramos. Esa lógica es propia de un negocio maduro que busca rentabilidad sostenible, no de una startup que regala servicios para ganar cuota.
Para los inversores en Nvidia antes del reporte del 26 de agosto, el cambio de precios de DeepSeek reduce el riesgo de que la eficiencia en modelos comprima drásticamente la demanda de chips. Si el proveedor más agresivo en precio del mercado global tuvo que cuadruplicar tarifas tras catorce semanas liderando el uso, la infraestructura sigue siendo el cuello de botella, no el software.