De acordo com pt.wedoany.com-Em 11 de agosto, a IBM e a plataforma de nuvem de inteligência artificial Together AI assinaram um acordo plurianual no valor de US$ 240 milhões. A IBM construirá nos Estados Unidos um cluster de inferência de IA em larga escala baseado nos sistemas NVIDIA HGX B300, fornecendo capacidade de computação em nuvem para o serviço de inferência de modelos abertos da Together AI. O cluster está programado para entrar em operação no primeiro trimestre de 2027.

O cluster será implantado no IBM Cloud, com a primeira fase prevista para configurar aproximadamente 2.000 chips NVIDIA Blackwell Ultra B300, utilizando a plataforma de rede Ethernet NVIDIA Spectrum-X para conectar os nós de computação. A IBM afirmou que este é o primeiro cluster de computação de sua plataforma de nuvem a adotar as tecnologias HGX B300 e Spectrum-X, construído especificamente para operações de inferência de IA em larga escala.
A plataforma HGX B300 é usada por fabricantes de servidores para construir sistemas de IA de alta densidade. Cada conjunto HGX B300 é configurado com 8 GPUs Blackwell Ultra, com capacidade total de memória de GPU de 2,1 TB, utilizando interconexão NVLink de quinta geração, com largura de banda total de interconexão entre GPUs de 14,4 TB/s e largura de banda de rede de 1,6 TB/s. Com base em aproximadamente 2.000 chips, a implantação da primeira fase equivale a cerca de 250 sistemas HGX B300 de oito GPUs, sendo que o número real de servidores e a configuração dos racks ainda dependerão do projeto de engenharia final.
Diferente dos clusters de computação usados principalmente para treinamento de modelos, este projeto foca em inferência de modelos, ou seja, utilizar modelos já treinados para processar solicitações de usuários e gerar texto, código ou outros conteúdos. A Together AI operará modelos abertos como DeepSeek, MiniMax e Kimi por meio deste cluster, oferecendo serviços de chamada de modelos e inferência de nível de produção para clientes empresariais.
Kai Mak, Chief Revenue Officer da Together AI, afirmou que a empresa espera que a capacidade de computação relacionada seja totalmente reservada dois a três meses antes do lançamento oficial. Atualmente, a Together AI processa cerca de 400 trilhões de tokens por mês. Com a expansão da implantação de modelos abertos por clientes empresariais, a empresa está aumentando seus recursos de GPU por meio de construção própria, locação e acordos de computação em nuvem de longo prazo.
Em julho de 2026, a Together AI concluiu uma rodada de financiamento Série C de US$ 800 milhões, com avaliação pós-investimento de US$ 8,3 bilhões. A rodada foi liderada pela Prosperity7 Ventures, braço da Saudi Aramco, com participação de NVIDIA, Vista Equity Partners, General Catalyst e outras instituições. A empresa planeja usar os recursos captados para expandir seus produtos e infraestrutura de computação, aumentando a escala geral da infraestrutura em cerca de 50 vezes nos próximos cinco anos.
Este acordo também expandirá a implantação de capacidade de computação Blackwell Ultra no IBM Cloud. A IBM já havia anunciado a oferta de GPUs NVIDIA Blackwell Ultra em sua plataforma de nuvem para cargas de trabalho de treinamento de grandes modelos, inferência e raciocínio complexo. Após a entrada em operação do novo cluster, a Together AI se tornará o principal usuário desse lote de capacidade de computação dedicada. As próximas etapas de ambas as partes incluem implantação de servidores, construção da rede Spectrum-X, integração da plataforma de software, depuração do cluster e operação comercial no primeiro trimestre de 2027.





















