MiniMax, da China, planeja lançar modelo de 2,7 trilhões de parâmetros no terceiro trimestre
De acordo com pt.wedoany.com-A startup chinesa de IA MiniMax Group está desenvolvendo um modelo de linguagem de grande escala com 2,7 trilhões de parâmetros, que poderá ser lançado já no terceiro trimestre. Este será o maior modelo de IA de código aberto já lançado por uma empresa chinesa e também poderá se tornar um dos maiores do mundo.
O impulso global por modelos de IA com trilhões de parâmetros decorre da crescente demanda por sistemas autônomos capazes de realizar raciocínios complexos. Analistas acreditam que esse patamar de escala é crucial para construir sistemas que possam executar operações de múltiplas etapas sem intervenção humana. Uma fonte informada, que pediu anonimato por não estar autorizada a divulgar informações publicamente, disse à Reuters. A MiniMax não comentou o assunto.
O plano de desenvolver este modelo gigante (cujos detalhes foram divulgados pela primeira vez pelo The Information) surge num momento em que modelos baratos baseados em tecnologia de código aberto, oferecidos por provedores chineses de IA, ganham atenção nos Estados Unidos e em outros mercados como alternativas de baixo custo aos sistemas proprietários americanos. Os concorrentes da MiniMax incluem empresas como Z.ai e DeepSeek. Modelos de código aberto permitem que os usuários baixem, executem e personalizem o sistema subjacente, ao contrário dos modelos proprietários de código fechado.
A fonte acrescentou ainda que a MiniMax lançará, ainda este mês, seu modelo de geração de vídeo multimodal de ponta, o H3.
Fundada em 2021, a MiniMax é uma empresa emergente no setor de IA da China. Em janeiro deste ano, a empresa levantou HK$ 4,8 bilhões (US$ 614 milhões) em sua oferta pública inicial em Hong Kong e planeja uma listagem secundária no Conselho de Inovação Científica e Tecnológica de Xangai. Atualmente, o Meituan LongCat-2.0 e o DeepSeek V4-Pro lideram o setor de IA chinês com um total de 1,6 trilhão de parâmetros, enquanto vários outros concorrentes domésticos já ultrapassaram o patamar de trilhão de parâmetros.
Embora os chatbots generativos padrão tenham um bom desempenho no processamento de textos curtos, eles apresentam limitações matemáticas quando precisam tomar decisões de longo prazo de forma independente.
Essa expansão massiva da arquitetura depende em grande parte da tecnologia de engenharia de especialistas mistos para equilibrar o nível de inteligência com os custos operacionais. Ao organizar o modelo em sub-redes especializadas, os desenvolvedores podem construir vastos bancos de dados com trilhões de parâmetros, ativando apenas uma pequena parte de suas capacidades a cada consulta. Essa abordagem permite que os usuários obtenham conhecimento de domínio profundamente especializado, incluindo regulamentações legais complexas e raros defeitos de software, com a alta velocidade e o baixo custo de sistemas de médio porte.
Produtos Relacionados





Software de Servidor de Aplicações Baolande V9.5
Beijing Baolande Software Corporation

Fibra monomodo não-dispersiva deslocada com extensão de faixa de comprimento de onda G.652.D
HONGAN GROUP CO. LTD


Cabo Óptico GYTA do tipo Não Auto-Suportado para Aéreo e Dutos
TONGDING INTERCONNECTION INFORMATION CO., LTD.
Estação Central em Nuvem da Internet das Coisas para Distribuição de Energia
XJ ELECTRIC CORPORATION
±1100kV Torre de Aço Angular para Corrente Contínua de Ultralta Tensão
Henan Dingli Pole & Tower Co., Ltd.








