DeepSeek presenta una alternativa a CUDA junto a Huawei para impulsar los chips de IA Ascend
DeepSeek y Huawei han dado un nuevo paso para reducir la dependencia de Nvidia en inteligencia artificial. Ambas compañías chinas han liberado un conjunto de herramientas de software diseñado para programar los aceleradores de IA Ascend y facilitar el desarrollo de modelos sobre hardware fabricado en China.
La iniciativa pone el foco en uno de los principales obstáculos para crear una infraestructura de IA independiente: sustituir CUDA, el ecosistema de desarrollo que Nvidia ha construido alrededor de sus GPU durante años. Su dominio no se limita a la potencia de los chips, sino que también abarca los compiladores, las bibliotecas y las herramientas que utilizan los desarrolladores.
El reto de abandonar el ecosistema CUDA
CUDA, siglas de Compute Unified Device Architecture, es una plataforma de software que permite programar las unidades de procesamiento gráfico de Nvidia para ejecutar tareas de cálculo paralelo. Estas operaciones son esenciales para entrenar y utilizar modelos de inteligencia artificial, ya que permiten procesar enormes volúmenes de datos al mismo tiempo.
La dependencia de CUDA se ha convertido en una de las principales ventajas competitivas de Nvidia. Muchos modelos, bibliotecas y aplicaciones de IA se han desarrollado pensando específicamente en este entorno. Por eso, trasladarlos a otro tipo de acelerador no consiste simplemente en cambiar un componente de hardware: en muchos casos exige adaptar o reescribir una parte importante del software.
Huawei cuenta con su propia plataforma, CANN, acrónimo de Compute Architecture for Neural Networks. Este entorno cumple una función similar a CUDA y está pensado para trabajar con los aceleradores Ascend. Sin embargo, la colaboración con DeepSeek pretende ampliar esa base con herramientas capaces de simplificar el trabajo de los programadores y aprovechar mejor el hardware chino.
TileLang, una pieza clave de la nueva plataforma
Una de las tecnologías que DeepSeek ha liberado es TileLang, un lenguaje de programación de alto nivel que sus ingenieros están adaptando a los aceleradores Ascend 950. Los lenguajes de alto nivel permiten escribir instrucciones de forma más comprensible y con menos detalle técnico que el código de bajo nivel.
En el ámbito de la IA, esta capa de abstracción resulta especialmente importante. Un lenguaje demasiado complejo puede ralentizar el desarrollo y obligar a los especialistas a conocer en profundidad la arquitectura interna de cada chip. En cambio, una herramienta bien optimizada puede permitir que los modelos se ejecuten en distintos aceleradores con menos modificaciones.
El objetivo de TileLang es combinar facilidad de uso y rendimiento. No basta con que los desarrolladores puedan adaptar rápidamente sus aplicaciones: el software también debe sacar partido de la memoria, los núcleos de cálculo y las unidades especializadas de los Ascend 950.
Herramientas para entrenar y ejecutar modelos
La colaboración entre DeepSeek y Huawei no se limita a un lenguaje de programación. Las dos compañías también han trabajado en bibliotecas de cálculo y comunicación entre chips, dos componentes fundamentales para los sistemas modernos de inteligencia artificial.
Las bibliotecas de cálculo reúnen funciones ya preparadas para operaciones habituales de los modelos, como multiplicaciones de matrices, gestión de tensores o procesamiento de datos. Los tensores son estructuras matemáticas que permiten representar y manipular grandes cantidades de información dentro de una red neuronal.
Por su parte, las herramientas de comunicación coordinan el intercambio de datos entre varios aceleradores. Esta tarea es crítica cuando un modelo se reparte entre numerosos chips, ya que las esperas y los cuellos de botella pueden reducir drásticamente el rendimiento global del sistema.
- TileLang: lenguaje de alto nivel adaptado a los aceleradores Ascend.
- Bibliotecas de cálculo: funciones optimizadas para las operaciones habituales de la IA.
- Herramientas de comunicación: software para coordinar el intercambio de datos entre chips.
- Compatibilidad con modelos: adaptaciones para ejecutar los sistemas de DeepSeek sobre hardware de Huawei.
Un supernodo con 128 aceleradores Ascend 950
DeepSeek y Huawei también han desarrollado un supernodo compuesto por 128 aceleradores Ascend 950. En este contexto, un supernodo es un sistema formado por varios chips conectados mediante una infraestructura de alta velocidad para trabajar como una única plataforma de cálculo.
Esta configuración permite distribuir el entrenamiento o la ejecución de un modelo entre múltiples aceleradores. La estrategia resulta relevante porque el rendimiento de un sistema de IA no depende únicamente de la potencia de cada chip, sino también de la velocidad con la que estos pueden compartir información.
Las optimizaciones realizadas por ambas empresas buscan mejorar tanto el rendimiento individual de los Ascend como las comunicaciones entre ellos. Es una cuestión decisiva para competir con las plataformas de Nvidia, que cuentan con años de experiencia en la construcción de sistemas completos para centros de datos.
El plan de DeepSeek para reforzar el hardware chino
DeepSeek ya había creado herramientas y optimizaciones para otros aceleradores de inteligencia artificial. Ahora está trasladando parte de ese trabajo al hardware de Huawei con la intención de que los desarrolladores no tengan que reconstruir desde cero la infraestructura necesaria para entrenar y ejecutar modelos.
La compañía también prevé desplegar al menos 160.000 aceleradores de Huawei en un gran centro de datos situado en Mongolia Interior. Si el proyecto se materializa, supondría un respaldo considerable para Ascend y proporcionaría a DeepSeek una plataforma de cálculo basada en tecnología china.
La alianza encaja con la estrategia de Pekín para reducir la dependencia de los componentes y las herramientas estadounidenses. Huawei, por su parte, aspira a ampliar la presencia de sus aceleradores más allá de China. La expansión internacional, sin embargo, puede verse condicionada por las restricciones de Estados Unidos y por la presión que Washington ejerce sobre sus países aliados.
Más que una simple adaptación de software, el proyecto representa un intento de construir un ecosistema completo para la inteligencia artificial: chips, compiladores, lenguajes, bibliotecas y sistemas de comunicación. Esa combinación será determinante para que Huawei y DeepSeek puedan ofrecer una alternativa real al dominio de Nvidia y CUDA.



