AWS e NVIDIA planejam adicionar 2 milhões de GPUs entre 2027 e 2028
De acordo com pt.wedoany.com-A Amazon Web Services (AWS) e a NVIDIA anunciaram uma expansão significativa de sua parceria estratégica para atender à crescente demanda global por infraestrutura de inteligência artificial. As empresas planejam implantar 2 milhões de GPUs NVIDIA adicionais na infraestrutura global da AWS, aprofundando a colaboração em áreas como fábricas de IA, CPUs, redes, modelos abertos, processamento de dados e robótica, para entregar soluções de IA co-projetadas aos clientes, acelerando o desenvolvimento e a implantação de IA.

Atualmente, as cargas de trabalho de IA estão migrando da fase de piloto para a fase de produção, com aplicações que se estendem a IA de agentes, descoberta científica, automação empresarial e robótica. Os clientes precisam de uma seleção mais ampla de modelos, pipelines de processamento de dados mais rápidos e capacidades para novos casos de uso, como IA física, ao mesmo tempo em que exigem que a infraestrutura subjacente mantenha os mais altos níveis de segurança e confiabilidade para cargas de trabalho críticas, sem comprometer o ritmo da inovação.
Com base em 16 anos de inovação conjunta, a AWS e a NVIDIA expandirão a capacidade de computação de IA e lançarão novas soluções co-projetadas para os clientes mais rapidamente. A AWS oferece a mais ampla variedade de instâncias de GPU entre todos os provedores de nuvem. Na NVIDIA GTC 2026, a AWS anunciou planos de adicionar mais de 1 milhão de GPUs NVIDIA a partir de 2026, e a demanda real superou essa expectativa. A AWS agora planeja implantar 2 milhões de GPUs NVIDIA Blackwell Ultra, Rubin e Rubin Ultra adicionais na infraestrutura global da AWS (incluindo fábricas de IA) entre 2027 e 2028, abrangendo cargas de trabalho de clientes como IA de agentes, descoberta científica, automação empresarial e IA física. Simultaneamente, a AWS expandirá a capacidade NVIDIA Blackwell, incluindo as GPUs NVIDIA RTX PRO 4500 Blackwell Server Edition para instâncias Amazon EC2 G7. As instâncias G7 oferecem desempenho de inferência de IA 4,6 vezes superior ao das instâncias G6 da geração anterior e desempenho gráfico 2,1 vezes superior. A AWS é o primeiro provedor de nuvem de grande porte a oferecer instâncias de computação aceleradas por RTX PRO 4500. Além disso, as empresas colaboram em redes NVIDIA Spectrum para otimizar o desempenho de rede entre clusters de GPUs em cargas de trabalho de treinamento de IA em larga escala.
Em computação de CPU, a AWS e a NVIDIA planejam introduzir infraestrutura baseada na CPU NVIDIA Vera na AWS, oferecendo opções adicionais para cargas de trabalho de IA de agentes que exigem computação de CPU de alto desempenho em sinergia com infraestrutura acelerada. A Vera é projetada para a próxima geração de IA e complementa a estratégia da AWS de oferecer uma ampla gama de opções de computação, desde chips proprietários até aceleradores e CPUs mais recentes de parceiros.
Em interconexão de chips e memória, a AWS anunciou na re:Invent 2025 suporte à tecnologia de interconexão de alta velocidade NVIDIA NVLink Fusion em seus chips Trainium de próxima geração. A NVIDIA e a Amazon Annapurna Labs estão expandindo esse suporte, colaborando com fornecedores de memória para introduzir a nova tecnologia de memória de alta largura de banda personalizada da NVIDIA (NVHBM) no Trainium, permitindo acesso a memória mais rápida e eficiente em termos energéticos. Combinado com o NVLink Fusion, a Annapurna Labs pode utilizar a tecnologia de memória personalizada da NVIDIA e a arquitetura de expansão vertical para melhorar o desempenho e a eficiência de cargas de trabalho de IA, integrando Trainium e GPUs em uma arquitetura comum em nível de rack.
Para clientes governamentais, a AWS e a NVIDIA planejam construir fábricas de IA para o governo dos EUA, entregando a pilha de software de IA da NVIDIA, e planejam disponibilizar 100 mil GPUs em infraestrutura segura da AWS para cargas de trabalho federais e de segurança nacional. Essa colaboração permite que agências governamentais implantem IA em larga escala para cargas de trabalho de Nível de Impacto 6 (Impact Level 6, IL6) e superiores.
Esta expansão da parceria baseia-se em várias integrações tecnológicas já implementadas. Todas as instâncias Amazon EC2 baseadas em GPU NVIDIA e baseadas em Trainium, incluindo aquelas que utilizam NVLink Fusion, são construídas sobre o AWS Nitro System e interconectadas por meio do Elastic Fabric Adapter (EFA). Além disso, as instâncias EC2 aceleradas por GPU e baseadas em Trainium continuarão a ser construídas sobre o Nitro System e expandidas via EFA. Nitro e EFA garantem coletivamente que, à medida que a AWS expande sua frota de GPUs NVIDIA e integra novas tecnologias de interconexão, os clientes continuem a obter a segurança, confiabilidade e desempenho de rede dos quais dependem para cargas de trabalho de IA de nível de produção. No ecossistema de software, a família de modelos abertos NVIDIA Nemotron já está disponível no Amazon Bedrock como modelos totalmente gerenciados e sem servidor, e no Amazon SageMaker para implantação e ajuste fino pelos clientes.
A aceleração de processamento de dados é outro resultado já implementado da colaboração. A AWS e a NVIDIA utilizam instâncias Amazon EC2 G7 e a biblioteca NVIDIA cuDF para oferecer processamento de dados acelerado por GPU no Amazon EMR, com velocidade de processamento até 3,7 vezes maior e custo-benefício 30% superior em comparação com configurações baseadas em CPU. Para atender à demanda por bancos de dados vetoriais em larga escala gerada por aplicações de IA, pipelines de geração aumentada por recuperação e busca semântica, os índices vetoriais acelerados por GPU no Amazon OpenSearch Service transferem a construção de índices para GPUs dedicadas, oferecendo velocidade de indexação vetorial até 9 vezes maior e custo de apenas um quarto do valor original, aplicável a clusters gerenciados e ao Amazon OpenSearch Serverless.
No campo da robótica, a Amazon Robotics está colaborando com a NVIDIA para integrar a plataforma completa de IA física da NVIDIA no desenvolvimento da próxima geração de robôs. A plataforma inclui NVIDIA Jetson, bibliotecas NVIDIA Omniverse e a plataforma aberta de desenvolvimento de robótica NVIDIA Isaac. A colaboração abrange simulação, geração de dados sintéticos, treinamento de robôs, otimização de rotas, segurança funcional e validação do mundo real para simulação, tudo executado em instâncias Amazon EC2 aceleradas por GPU para suportar a simulação em larga escala, dados de treinamento diversificados e validação contínua no mundo real exigidos por cargas de trabalho robóticas.
Produtos Relacionados


Terminal satelital portátil de placa Terminal portátil manual com abertura de 0,35 metros
China Starwin Science & Technology co., Ltd.
Sistema de informação inteligente
LUOYANG SHANHAI MACHINERY MANUFACTURING CO., LTD.


Coletor Inteligente de Dados DataHub 1000
SOLAX POWER NETWORK TECHNOLOGY (ZHEJIANG) CO., LTD.

Estação Central em Nuvem da Internet das Coisas para Distribuição de Energia
XJ ELECTRIC CORPORATION
Série DYJWGB-50 Dispositivo Terminal Remoto (RTU) com GPRS
Ningbo Donghai Group Co., Ltd.

Solução de Prevenção contra Vazamento de Dados para Escritórios
Sangfor Technologies Inc.
Cabo Óptico GYTA do tipo Não Auto-Suportado para Aéreo e Dutos
TONGDING INTERCONNECTION INFORMATION CO., LTD.








