Acelerador de Inferência Groq 3 LPX da NVIDIA entra em produção em massa

2026-08-25 14:22
Favoritos

De acordo com pt.wedoany.com-Em 24 de agosto, a NVIDIA anunciou na conferência Hot Chips 2026 que seu acelerador Groq 3 LPX, projetado especificamente para inferência de agentes de IA, entrou em produção em massa, marcando a comercialização oficial do primeiro produto após a empresa adquirir a licença da tecnologia de chips Groq por US$ 20 bilhões em dezembro de 2025.

O Groq 3 LPX é o acelerador de inferência especializado da plataforma de dados Vera Rubin da NVIDIA, focado na fase de "decodificação" da inferência de IA — o elo crítico que determina a taxa de geração de tokens. Um único rack LPX integra 256 aceleradores Groq 3 LPU, equipados com 128 GB de SRAM on-chip e 640 TB/s de largura de banda de expansão entre chips, adotando a arquitetura de rack MGX da NVIDIA com resfriamento líquido total. O chip é fabricado pela Samsung Electronics, criando uma diferenciação na cadeia de suprimentos em relação às GPUs da NVIDIA (fabricadas pela TSMC).

Nos testes de benchmark da organização terceirizada Artificial Analysis, o Groq 3 LPX, ao executar o modelo de código aberto Gemma 4 31B com contexto longo de 100 mil tokens, alcançou uma velocidade de geração de 3.400 tokens de saída por segundo, que a NVIDIA afirma ser o desempenho de inferência mais rápido já registrado para esse modelo, sendo 4 vezes mais rápido que plataformas concorrentes em tarefas sensíveis à latência.

O provedor de serviços de nuvem de IA Nebius já assinou contrato como o primeiro cliente de implantação do Groq 3 LPX, oferecendo aos desenvolvedores a capacidade de geração ultrarrápida de tokens do acelerador por meio da plataforma de inferência Nebius Token Factory. Dion Harris, diretor sênior da NVIDIA, afirmou que os racks Groq serão implantados na Nebius juntamente com as unidades centrais de processamento Vera e as unidades de processamento gráfico Rubin, com previsão de lançamento oficial no segundo semestre de 2026. O diretor de tecnologia da Nebius, Danila Shtan, declarou: "A geração é a fase de inferência que determina a velocidade de resposta dos sistemas de IA, e é exatamente isso que o Groq 3 LPX acelera."

O fundador e CEO da NVIDIA, Jensen Huang, afirmou que a plataforma Vera Rubin, por meio do Groq 3 LPX, alcançou uma configuração otimizada de fábrica de computação para a era dos agentes de IA, "isso muda a forma como a inteligência é produzida, representando outro salto gigantesco em throughput, eficiência e velocidade de resposta da IA".

Harris enfatizou que o Groq 3 LPX não substitui as GPUs, mas sim utiliza o processador ideal para cargas de trabalho específicas — as GPUs continuam responsáveis pelo treinamento de modelos e inferência de uso geral, enquanto os chips Groq se concentram na fase de "decodificação" sensível à latência. A NVIDIA também anunciou que a SpaceX assinou contrato como o mais recente cliente flagship da plataforma Vera Rubin, implantando CPUs Vera para tarefas de orquestração e simulação intensivas em CPU em data centers terrestres e satélites orbitais. O volume de remessas do sistema Vera Rubin está acelerando, com a produção do sistema tendo sido iniciada no início de 2026.

Este boletim é uma compilação e reprodução de informações de parceiros estratégicos e da internet global, destinado apenas para troca de informações entre leitores. Em caso de infração ou outros problemas, por favor, informe-nos imediatamente, e este site fará as devidas modificações ou exclusões. A reprodução deste artigo é estritamente proibida sem autorização formal. E-mail: news@wedoany.com