75% menos HBM necesita DeepSeek pero Micron aguanta en $975 tras el susto

María González · Empresas y Resultados · 2026-09-13

El modelo chino recorta a un cuarto la memoria para inferencia y desafía la tesis de escasez. Wall Street no vende; Seúl sí.

Micron cerró el viernes 11 de septiembre en $975,26, prácticamente plano (-0,22%), un día después de que DeepSeek anunciara que su modelo V4.1-Flash necesita 75% menos memoria <abbr title="High Bandwidth Memory, memoria de alto ancho de banda usada en chips de IA">HBM</abbr> y 87,5% menos almacenamiento SSD para <abbr title="Key-Value cache, almacenamiento de estados intermedios durante la inferencia de modelos de lenguaje">KV-cache</abbr> que su generación anterior. La tesis de escasez estructural de memoria no se desplomó en Wall Street, pero sí asustó a Seúl: Samsung cayó 3,5% y SK Hynix 2,2% en la sesión del jueves 10.

75% menos HBM necesita DeepSeek pero Micron aguanta en $975 tras el susto

Cuatro veces menos HBM, ocho veces menos SSD

DeepSeek no afirma que el modelo completo ni el data center entero consuman 75% menos memoria. La comparación cubre KV-cache, el almacenamiento de estados de atención durante inferencia, y se mide contra su propia arquitectura anterior, no contra pesos del modelo ni entrenamiento. El modelo reduce el <abbr title="Memoria requerida por cada token procesado durante la inferencia">KV-cache global</abbr> a ~890 bytes por token, una cuarta parte de lo que V4-Flash pedía. Eso sí elimina un cuello de botella real: el cache crece linealmente con la longitud de contexto y presiona HBM y SSD cuando se despliegan contextos ultra-largos.

El costo de cache-hit en horario off-peak bajó a $0,003 por token, desde los $0,022 que cobraba V4-Pro. Para una carga de 100M input / 10M output, el costo nominal baja a $21,00, una reducción del 75,5% frente a los ~$85,80 anteriores. Desde el 14 de septiembre a las 04:00 UTC, las solicitudes a deepseek-v4-pro se redirigen automáticamente a V4.1-Flash con tarifas Flash.

Seúl vende, Wall Street aguanta

Inmediatamente tras el anuncio del jueves 10 de septiembre, SK Hynix cayó hasta 5,8% en operaciones estadounidenses y Micron bajó hasta 5,3% intraday. Pero al cierre del viernes 11, Micron apenas retrocedió dos décimas de punto y SanDisk perdió 3,5% ($1.633,35). La divergencia geográfica fue clara: en Seúl, Samsung y SK Hynix acumularon caídas de entre 2,2% y 3,5%, mientras los nombres estadounidenses se estabilizaron.

¿Por qué Wall Street no vendió con pánico? Micron reportó en su último trimestre fiscal márgenes brutos de 83% en Cloud Memory, igualando a Nvidia, y tiene HBM3E y HBM4 completamente reservados hasta 2027, con demanda extendiéndose a 2028. La firma de Boise aseguró $22.000 millones en acuerdos estratégicos, incluyendo $18.000 millones en depósitos en efectivo. SanDisk, por su parte, disparó su revenue de data center 233% secuencial a $1.467 millones en Q3, con el pricing generando dos tercios del aumento.

75% menos HBM necesita DeepSeek pero Micron aguanta en $975 tras el susto

El riesgo no es hoy, es 2027

Si otros modelos copian la arquitectura de DeepSeek y generalizan la compresión de cache, ¿qué pasa con los $22.000 millones ya asegurados? Nada: esos contratos están firmados y el backlog cubre hasta 2027. El problema aparece si en 2028 la demanda de tokens crece, pero la intensidad de memoria por token cae más rápido. Micron y SanDisk aún pueden vender más si el volumen de inferencia explota; la pregunta es si ese volumen crece más rápido que la compresión.

Un cálculo simple: si DeepSeek reduce memoria 75% pero el volumen de tokens procesados sube 4x, el consumo total de HBM queda igual. Si sube solo 3x, cae 25%. Si sube 5x, crece 25%. El mercado apostó el viernes a que volumen vence a compresión, al menos en el horizonte visible. Como ya publicamos con Arista, Wall Street descuenta riesgo de supply, no colapso de demanda.

La eficiencia puede estimular uso sin preservar intensidad. Eso es exactamente lo que pasó con el cloud: Amazon redujo costes por gigabyte año tras año, pero el gasto total en almacenamiento mundial creció porque aparecieron más aplicaciones. DeepSeek abre la puerta a que modelos baratos inunden inferencia. Si eso multiplica tokens procesados por cinco, Micron gana. Si solo lo duplica, pierde margen y volumen post-2027.

Por ahora, el mercado no castiga. Seúl sí lo hizo; Wall Street prefiere esperar datos de adopción real antes de descontar un escenario que aún no existe. El viernes cerró con Micron en $975, SanDisk en $1.633 y un backlog de HBM que no se evapora por un technical report de 50 páginas en Hugging Face.