De acordo com pt.wedoany.com-A Microsoft anunciou que implantará em grande escala o sistema de rack Helios, fabricado pela AMD, em seus data centers, para aprimorar a capacidade de computação de IA da plataforma de nuvem Azure. Esta parceria representa um avanço significativo da AMD no mercado de GPUs para data centers, permitindo que os clientes do Azure executem cargas de trabalho de modelos de IA de ponta, abrangendo tarefas de treinamento e inferência, utilizando as GPUs mais recentes da AMD.

O AMD Helios é um sistema de rack projetado especificamente para competir com o Nvidia Vera Rubin NVL72. O sistema integra 72 GPUs Instinct MI455X da última geração, com uma capacidade total de memória HBM4 de 31,1 TB. Seu desempenho computacional atinge 1,4 exaFLOPS em precisão FP8 e 2,9 exaFLOPS em precisão FP4, sendo otimizado para modelos modernos de IA.

O Helios atinge uma largura de banda de expansão intra-rack de 260 TB/s, comparável ao sistema Nvidia Vera Rubin NVL72. Na expansão entre racks, o Helios oferece 43 TB/s de largura de banda através da conexão UALink over Ethernet, o dobro do Vera Rubin. No entanto, o desempenho real do UALink over Ethernet ainda precisa ser validado na prática. Nem a Microsoft nem a AMD divulgaram o investimento específico de implantação ou as métricas de consumo de energia. Anteriormente, a AMD já havia estabelecido parcerias com a OpenAI e a Meta, com potencial valor de centenas de bilhões de dólares.
Além do Helios, a Microsoft também lançou duas novas séries de máquinas virtuais baseadas no processador AMD Epyc Venice de sexta geração: a série HDv2, voltada para cargas de trabalho de agentes de IA e pipelines de dados, e a série HXv2, direcionada a fluxos de trabalho de design de semicondutores. A Microsoft também planeja integrar o DPU AMD Pensando ao serviço Azure Boost para acelerar o processamento de rede e armazenamento. Esta série de colaborações indica que os clientes do Azure agora têm opções mais diversificadas de computação de IA, não dependendo mais exclusivamente das GPUs da Nvidia. Com o surgimento de modelos de código aberto como o Kimi K3, a demanda por computação de IA continua a crescer, permitindo que as empresas escolham a infraestrutura adequada com base em requisitos de desempenho, custo e disponibilidade.
A AMD planeja lançar o Helios até o final deste ano, coincidindo com o lançamento do Nvidia Vera Rubin NVL72. Espera-se que a concorrência entre os dois gigantes de semicondutores no mercado de GPUs para data centers se intensifique cada vez mais.










