Acelerador de Inferência Groq 3 LPX da NVIDIA entra em produção em massa
De acordo com pt.wedoany.com-Em 24 de agosto, a NVIDIA anunciou na conferência Hot Chips 2026 que seu acelerador Groq 3 LPX, projetado especificamente para inferência de agentes de IA, entrou em produção em massa, marcando a comercialização oficial do primeiro produto após a empresa adquirir a licença da tecnologia de chips Groq por US$ 20 bilhões em dezembro de 2025.

O Groq 3 LPX é o acelerador de inferência especializado da plataforma de dados Vera Rubin da NVIDIA, focado na fase de "decodificação" da inferência de IA — o elo crítico que determina a taxa de geração de tokens. Um único rack LPX integra 256 aceleradores Groq 3 LPU, equipados com 128 GB de SRAM on-chip e 640 TB/s de largura de banda de expansão entre chips, adotando a arquitetura de rack MGX da NVIDIA com resfriamento líquido total. O chip é fabricado pela Samsung Electronics, criando uma diferenciação na cadeia de suprimentos em relação às GPUs da NVIDIA (fabricadas pela TSMC).
Nos testes de benchmark da organização terceirizada Artificial Analysis, o Groq 3 LPX, ao executar o modelo de código aberto Gemma 4 31B com contexto longo de 100 mil tokens, alcançou uma velocidade de geração de 3.400 tokens de saída por segundo, que a NVIDIA afirma ser o desempenho de inferência mais rápido já registrado para esse modelo, sendo 4 vezes mais rápido que plataformas concorrentes em tarefas sensíveis à latência.
O provedor de serviços de nuvem de IA Nebius já assinou contrato como o primeiro cliente de implantação do Groq 3 LPX, oferecendo aos desenvolvedores a capacidade de geração ultrarrápida de tokens do acelerador por meio da plataforma de inferência Nebius Token Factory. Dion Harris, diretor sênior da NVIDIA, afirmou que os racks Groq serão implantados na Nebius juntamente com as unidades centrais de processamento Vera e as unidades de processamento gráfico Rubin, com previsão de lançamento oficial no segundo semestre de 2026. O diretor de tecnologia da Nebius, Danila Shtan, declarou: "A geração é a fase de inferência que determina a velocidade de resposta dos sistemas de IA, e é exatamente isso que o Groq 3 LPX acelera."
O fundador e CEO da NVIDIA, Jensen Huang, afirmou que a plataforma Vera Rubin, por meio do Groq 3 LPX, alcançou uma configuração otimizada de fábrica de computação para a era dos agentes de IA, "isso muda a forma como a inteligência é produzida, representando outro salto gigantesco em throughput, eficiência e velocidade de resposta da IA".
Harris enfatizou que o Groq 3 LPX não substitui as GPUs, mas sim utiliza o processador ideal para cargas de trabalho específicas — as GPUs continuam responsáveis pelo treinamento de modelos e inferência de uso geral, enquanto os chips Groq se concentram na fase de "decodificação" sensível à latência. A NVIDIA também anunciou que a SpaceX assinou contrato como o mais recente cliente flagship da plataforma Vera Rubin, implantando CPUs Vera para tarefas de orquestração e simulação intensivas em CPU em data centers terrestres e satélites orbitais. O volume de remessas do sistema Vera Rubin está acelerando, com a produção do sistema tendo sido iniciada no início de 2026.
Produtos Relacionados

Solução de Prevenção contra Vazamento de Dados para Escritórios
Sangfor Technologies Inc.
Radar de Monitoramento Oceânico Multifuncional para Baixa Altura – Medição de Ambiente Dinâmico Marítimo e Atmosférico
Chengdu Dixin Technology Co., Ltd.
Software do Sistema de Verificação / Calibração de Pressão ACal
Beijing ConST Instruments Technology Inc.

Sistema de monitorização e posicionamento de falhas de isolamento
Shanghai Complee Instrument Co., Ltd.


QPS- 20A Comutador Rápido de Fonte de Alimentação Redundante
CHN ENERGY ZHISHEN CONTROL TECHNOLOGY CO., LTD.
Terminal satelital portátil de placa Terminal portátil manual com abertura de 0,35 metros
China Starwin Science & Technology co., Ltd.
Switch Industrial Nacional 100%
Shenzhen Yuhang Communication Technology Co., Ltd.

Série DYJWGB-50 Dispositivo Terminal Remoto (RTU) com GPRS
Ningbo Donghai Group Co., Ltd.








