AMD Helios: Schneider Electric presenta un nuevo diseño para centros de datos de IA

Schneider Electric y AMD desarrollaron y validaron conjuntamente un diseño de referencia basado en AMD Helios para facilitar el despliegue de infraestructura de IA de alta densidad, integrando energía, refrigeración, espacio de TI y software para reducir la complejidad y acelerar la construcción de fábricas de IA.
La plataforma AMD Helios integra GPUs Instinct, procesadores EPYC y redes Pensando para soportar cargas de trabajo de inteligencia artificial de alta densidad.
La plataforma AMD Helios integra GPUs Instinct, procesadores EPYC y redes Pensando para soportar cargas de trabajo de inteligencia artificial de alta densidad.
Compartir nota:

Schneider Electric y AMD avanzan en su estrategia conjunta para simplificar el despliegue de infraestructura de inteligencia artificial de alta densidad. Ambas compañías presentaron un diseño de referencia desarrollado y validado en conjunto para la plataforma rackscale AMD Helios, con el objetivo de ofrecer a las organizaciones un modelo escalable que permita reducir los tiempos de implementación, los riesgos de integración y la complejidad asociada a las nuevas fábricas de IA.

El anuncio representa el primer hito de la colaboración entre Schneider Electric y AMD y apunta a resolver uno de los principales desafíos que enfrenta actualmente la industria: cómo diseñar centros de datos capaces de soportar cargas de trabajo de inteligencia artificial cada vez más exigentes, sin comprometer la eficiencia energética, la refrigeración ni la capacidad de expansión.

AMD Helios: infraestructura preparada para la nueva generación de IA

El nuevo diseño de referencia fue desarrollado para soportar cargas de trabajo de alta densidad sobre AMD Helios, una arquitectura rackscale que integra distintos componentes destinados a maximizar el rendimiento de las aplicaciones de inteligencia artificial.

La plataforma está impulsada por GPUs AMD Instinct MI455X, procesadores AMD EPYC de sexta generación, tarjetas de red AMD Pensando Vulcano y el ecosistema de software abierto ROCm. La combinación busca incrementar la capacidad de cómputo, el ancho de banda de interconexión y la capacidad de memoria, al mismo tiempo que mejora la integración a nivel de sistema.

AMD Helios fue diseñado para ofrecer mayor rendimiento, eficiencia y escalabilidad frente a las nuevas cargas de trabajo de IA.
AMD Helios fue diseñado para ofrecer mayor rendimiento, eficiencia y escalabilidad frente a las nuevas cargas de trabajo de IA.

La propuesta responde a una evolución en la infraestructura tecnológica. A medida que los modelos de IA se vuelven más grandes y complejos, las empresas necesitan sistemas capaces de procesar mayores volúmenes de información y ejecutar cargas de trabajo intensivas de manera eficiente.

En este escenario, AMD Helios busca proporcionar una arquitectura abierta y escalable a nivel de rack, preparada para las necesidades de las próximas generaciones de inteligencia artificial.

Un plano para reducir la complejidad de los centros de datos

Uno de los principales aportes del diseño de referencia desarrollado por Schneider Electric y AMD es la posibilidad de contar con una infraestructura previamente validada antes de avanzar hacia la implementación física.

Las cargas de IA de alta densidad están llevando a los centros de datos a enfrentar nuevos desafíos relacionados con el consumo energético, la disipación térmica, la distribución del espacio y la operación de los sistemas. Por eso, los diseños de referencia permiten a arquitectos y operadores trabajar sobre modelos probados y escalables.

El diseño contempla cuatro áreas técnicas fundamentales: energía de la instalación, refrigeración de la instalación, espacio destinado a TI y software para la gestión del ciclo de vida.

La integración de estos componentes permite anticipar necesidades de infraestructura y establecer cómo deben organizarse los sistemas eléctricos, térmicos y tecnológicos. De esta manera, las compañías pueden acortar las etapas de planificación y avanzar hacia implementaciones de IA con mayor previsibilidad.

Energía y refrigeración, claves para las fábricas de IA

La colaboración también pone el foco en un aspecto central de la expansión de la inteligencia artificial: la necesidad de diseñar computación, redes, energía y refrigeración como partes de un mismo sistema.

Manish Kumar, vicepresidente ejecutivo de Secure Power & Data Centers de Schneider Electric, destacó que las organizaciones necesitan diseños de referencia integrales que permitan pasar de la planificación a la implementación de manera más rápida y con menor riesgo.

Según el ejecutivo, la colaboración con AMD permite combinar plataformas avanzadas de computación para IA con tecnologías de energía y capacidades de infraestructura para centros de datos, con el objetivo de facilitar el despliegue de entornos de alta densidad.

Desde AMD, Forrest Norrod, vicepresidente ejecutivo y director general del Grupo de Negocios de Soluciones para Centros de Datos, señaló que la evolución hacia fábricas de IA a gran escala exige una planificación conjunta de todos los componentes de infraestructura.

En ese sentido, el ejecutivo sostuvo que AMD Helios fue concebido para ofrecer rendimiento, eficiencia y flexibilidad para las cargas de trabajo de IA de próxima generación, mientras que el diseño validado junto con Schneider Electric busca reducir el riesgo de integración y acelerar la implementación.

Un estándar para la expansión global

El diseño de referencia fue validado de acuerdo con los estándares ANSI para despliegues en Estados Unidos. Sin embargo, la colaboración contempla ampliar el marco para incorporar estándares IEC y facilitar su utilización en implementaciones internacionales.

El objetivo es que el modelo pueda adaptarse a diferentes mercados y necesidades de infraestructura, tanto para nuevas fábricas de IA como para instalaciones de alta densidad que requieran modificaciones y ampliaciones.

Con este primer diseño de referencia, Schneider Electric y AMD buscan establecer un camino más directo hacia la implementación de fábricas de IA, combinando capacidad de cómputo, infraestructura energética, refrigeración y gestión tecnológica.

La iniciativa refleja, además, un cambio en la forma de abordar los centros de datos orientados a inteligencia artificial: ya no alcanza con incorporar servidores y aceleradores de mayor rendimiento. La infraestructura completa debe ser diseñada desde el inicio para responder a las exigencias energéticas, térmicas y operativas de estas nuevas cargas de trabajo.

Preguntas frecuentes

1. ¿Qué es una fábrica de IA?
Una fábrica de IA es una infraestructura de cómputo diseñada específicamente para producir y procesar grandes volúmenes de inteligencia artificial. A diferencia de un centro de datos convencional, está orientada a cargas como entrenamiento de modelos, inferencia a gran escala y aplicaciones de IA generativa.

2. ¿Por qué las fábricas de IA requieren una infraestructura diferente?
El crecimiento de los modelos de IA está aumentando las necesidades de procesamiento, memoria, conectividad y eficiencia energética. Esto obliga a diseñar los centros de datos considerando simultáneamente el rendimiento informático y las condiciones físicas necesarias para mantener los sistemas funcionando de manera estable.

3. ¿Qué diferencia existe entre una arquitectura tradicional de servidores y una solución rackscale?
En una arquitectura rackscale, los distintos componentes del sistema se conciben como una unidad integrada dentro del rack, en lugar de tratar cada servidor de forma aislada. Esto permite optimizar la comunicación entre aceleradores, procesadores y redes y facilita la expansión de grandes clústeres de IA. AMD describe Helios como un bloque integrado de infraestructura para IA.

4. ¿Qué tipo de cargas de trabajo puede ejecutar AMD Helios?
La plataforma está orientada principalmente a aplicaciones de IA de gran escala, incluyendo entrenamiento de modelos fundacionales, inferencia avanzada y otras cargas de trabajo que requieren grandes cantidades de capacidad de cómputo. AMD señala que Helios está diseñado específicamente para infraestructura de IA de próxima generación.

5. ¿Qué papel cumple ROCm dentro del ecosistema de AMD Helios?
ROCm es la plataforma de software abierto de AMD para computación acelerada por GPU. Su función es proporcionar herramientas y bibliotecas que permiten desarrollar, adaptar y optimizar aplicaciones de inteligencia artificial para los aceleradores de AMD. El ecosistema cuenta además con compatibilidad con frameworks ampliamente utilizados en IA, como PyTorch y Hugging Face.

Leer más

Compartir nota:

Publicaciones Relacionadas

Scroll to Top