
Microsoft amplía la infraestructura de IA y HPC de Azure con AMD
Por Scott Guthrie, vicepresidente Ejecutivo, Nube e IA en Microsoft:
Las cargas de trabajo de IA escalan más rápido de lo que cualquier enfoque de infraestructura puede soportar, con más modelos, nuevas cargas de trabajo impulsadas por agentes y una demanda de cómputo creciente que impulsa la necesidad de una mayor especialización en toda la pila tecnológica. Para satisfacer esta necesidad, Microsoft sigue evolucionando la infraestructura de Azure, incluida la ampliación de su flota de infraestructura de IA con las soluciones más avanzadas de AMD para inteligencia artificial y computación de alto rendimiento (HPC).
Nuestro enfoque de infraestructura de IA está diseñado para respaldar las diversas formas en que se crean y operan los sistemas de IA. Trabajamos estrechamente con innovadores de la industria como AMD y combinamos sus avances con nuestro propio silicio y sistemas especializados para ofrecer a los clientes una plataforma integral, abierta y heterogénea que proporcione los mejores resultados en rendimiento, costo y eficiencia energética.
A partir de nuestra colaboración con AMD, Microsoft está trayendo a Azure la última plataforma de IA AMD Helios y los procesadores EPYC de próxima generación para centros de datos. Estas tecnologías impulsarán tres próximas ofertas de Azure: Maquinas virtuales (VMs) HDv2 para procesamiento de datos, VMs HXv2 para automatización del diseño electrónico (EDA) y VMs ND MI455X v7 para cargas de trabajo de inferencia de IA.
Construido para sistemas de datos de IA — Azure HDv2
La infraestructura de CPU es esencial para el rendimiento y la eficiencia de los sistemas modenos de IA. Los aceleradores de IA dependen de una capacidad de cómputo de CPU de alta densidad y bajo consumo energético para procesar datos, coordinar cargas de trabajo y mantener las canalizaciones funcionando a escala. Sin ella, los procesos de entrenamiento no cuentan con suficientes datos para aprender y los agentes no tienen la capacidad necesaria para realizar tareas en nombre de los clientes.
Las máquinas virtuales Azure HDv2 son una de nuestras ofertas más recientes, diseñadas desde cero para eliminar estos cuellos de botella e impulsar la adopción masiva de cargas de trabajo basadas en agentes.
Codiseñadas con AMD, las máquinas virtuales HDv2 amplían el portafolio de soluciones especializadas de Azure para las cargas de trabajo de CPU más exigentes de los clientes de IA, incluidas la preparación de datos, la búsqueda, el aprendizaje por refuerzo y la coordinación de agentes a escala.
Con casi 500 núcleos físicos de CPU AMD EPYC de sexta generación, 4 terabytes de RAM, 32 terabytes de almacenamiento NVMe local y conectividad de red Azure Boost de 400 Gb, las máquinas virtuales HDv2 están diseñadas para responder a las necesidades de los clientes con las cargas de trabajo de IA más exigentes.
Optimizada para diseño de silicio y computación técnica — Azure HXv2
La era de la IA ha generado una enorme necesidad y una gran oportunidad para las empresas que desarrollan los chips que impulsan esta infraestructura. Por esta razón, las máquinas virtuales Azure HX, lanzadas en colaboración con AMD en 2023 e impulsadas por la exclusiva tecnología 3D V-Cache de AMD, han tenido una adopción significativa entre las empresas de diseño de chips que trabajan para llevar al mercado soluciones de IA más potentes y eficientes.
Hoy anunciamos el siguiente paso de nuestra estrategia de optimización para las cargas de trabajo de estos clientes: HXv2.
Las máquinas virtuales HXv2 aprovechan y amplían las fortalezas de HX. Ambas generaciones mantienen la ventaja diferencial que Azure ofrece para las cargas de trabajo de simulación RTL al incorporar nuevamente la tecnología 3D V-Cache, además de ofrecer mejoras significativas en el rendimiento de un solo hilo y en la capacidad de memoria.
Las máquinas virtuales HXv2 contarán con 176 núcleos de CPU AMD EPYC de sexta generación, con una frecuencia de reloj superior a 5 GHz, un 50 % más de caché direccionable por núcleo y configuraciones de VM con casi 2 o 4 terabytes de RAM. Esto ayudará a los clientes a optimizar sus cargas de trabajo de acuerdo con sus necesidades de memoria.
Azure HXv2 también está diseñada para soportar una gama más amplia de cargas de trabajo de computación técnica, incluyendo simulación científica, análisis de ingeniería y otras aplicaciones de memoria distribuida. El aumento significativo de rendimiento por VM y por núcleo, junto con la inclusión de 800 Gb de InfiniBand, permiten simulaciones a gran escala basadas en MPI y hacen que HXv2 sea una opción ideal para una amplia variedad de clientes HPC.
Inferencia de IA a escala de producción — ND MI455X v7
ND MI455X v7 está diseñada para las cargas de razonamiento, búsqueda y agentes detrás de los servicios modernos de IA. Impulsado por la solución AMD Helios en rackscale, amplía las opciones de infraestructura de Azure para inferencia a gran escala y está diseñado para ofrecer un rendimiento y eficiencia sólidos para cargas de trabajo de IA exigentes.
En conjunto, estas nuevas funcionalidades fortalecen las capacidades de Azure y ofrecen a los clientes una mayor flexibilidad para elegir los recursos de cómputo adecuados para cada flujo de trabajo de IA, desde la inferencia y los sistemas de datos hasta el diseño de chips.
La capacidad de elección del cliente es un principio fundamental integrado directamente en el diseño de Microsoft Azure, y nos entusiasma llevar las innovaciones más avanzadas de AMD a una escala de producción.
WhatsApp eSemanal 55 7360 5651
También te puede interesar:
Microsoft e Ingram Micro impulsan modelo híbrido de IA, nube y dispositivos para acelerar el negocio
Microsoft cumple 40 años en México impulsando la transformación digital y el crecimiento con IA, anuncia inversión
Cuatro de las supercomputadoras más rápidas del mundo operan con tecnología AMD
AMD presenta procesadores EPYC 8005 para servidores




