- Según DeepSeek la infraestructura utilizada para entrenar este modelo de IA contiene 2.048 chips H800 de NVIDIA
- Algunos analistas defienden que su hardware aglutina 50.000 GPU H100 compradas a través de intermediarios
Es la información del momento. Y tal vez, de la semana. El modelo de inteligencia artificial (IA) chino de código abierto DeepSeek R1 está generando una gran conmoción en las empresas tecnológicas de Estados Unidos. Y lo está realizando por su carácter abierto.
Sin embargo, su modelo comercial no es lo único que constituye un riesgo para las compañías de IA y semiconductores en EEUU. Lo más impresionante es que la infraestructura que respalda a DeepSeek es bastante sencilla.
Para comprender con mayor claridad de qué se trata, es importante mencionar que el chip H100 de NVIDIA es la GPU para IA que se usa más comúnmente en los centros de datos en la actualidad. La empresa bajo la dirección de Jensen Huang ha comenzado a suministrar las primeras unidades de su nueva versión, la plataforma B200, que, como era de esperar, en teoría es aún más poderosa.
No obstante, las restricciones impuestas por el Gobierno de EE. UU. impiden a NVIDIA comercializar estas GPU a su clientela en China. Aquí radica en gran medida la capacidad innovadora de DeepSeek.
La efectividad de DeepSeek y su caracter abierta están revolucionando Silicon Valley.
Las empresas chinas enfocadas en el desarrollo y entrenamiento de modelos de IA no han tenido más remedio que afinar su creatividad. Sabemos que muchas de ellas continúan adquiriendo las GPU más avanzadas de NVIDIA mediante intermediarios y en mercados alternativos, aunque es probable que no lo hagan en las cantidades requeridas.
Si nos limitamos a DeepSeek, el Financial Times informa que la infraestructura que sirve para entrenar este modelo reúne 2.048 chips H800 de NVIDIA. Y la formación con 671.000 millones de parámetros ha tenido un coste de 5,6 millones de dólares.
Con Informacion de XATAKA
