De acordo com pt.wedoany.com-Na feira WAIC 2026, a empresa chinesa Mech-Mind Robotics apresentou um sistema "olho-cérebro-mão" composto por um sistema de visão 3D, um modelo multimodal de grande escala e uma mão hábil, permitindo que robôs humanoides e braços robóticos executem tarefas complexas em cenários reais.
Ao contrário de outros robôs que dançam ou lutam nos estandes, os robôs da Mech-Mind demonstraram capacidades mais próximas de aplicações práticas. Um robô humanoide, posicionado diante de uma prateleira, selecionou com precisão produtos com base em comandos de voz do público e os entregou a um balcão de retirada; outro braço robótico montou rapidamente peças finas de chapa metálica de formatos variados. Essas demonstrações focaram na capacidade operacional, generalização e versatilidade entre diferentes corpos robóticos em cenários complexos.
A entrada de robôs em fábricas enfrenta diversos desafios, incluindo iluminação ambiente variável, matérias-primas e peças de diferentes especificações, e tarefas em constante mudança. A demonstração da Mech-Mind mostrou soluções para esses desafios. Dois robôs humanoides trabalharam em conjunto para realizar a carga e descarga de peças e o transporte de cestos, executando uma operação contínua desde a pega até o transporte. Em outro cenário, um braço robótico realizou a montagem precisa de conectores de chicotes flexíveis com precisão sub-milimétrica.

Na demonstração de pega de porcas pentagonais, o robô levou menos de 2,4 segundos por peça, com velocidade e eficiência compatíveis com o ritmo da linha de produção. Essas capacidades já foram amplamente implementadas em setores manufatureiros como o automotivo.
Cenários de varejo e domésticos também testam a capacidade de generalização dos robôs. Os robôs da Mech-Mind conseguem classificar uma vasta gama de objetos do dia a dia e separar objetos transparentes com propriedades ópticas complexas.

Todas as capacidades mencionadas vêm do sistema "olho-cérebro-mão" desenvolvido internamente pela Mech-Mind. O sistema inclui um sistema de visão 3D de nível industrial, capaz de identificar peças de paredes finas e objetos transparentes e gerar imagens em alta velocidade; o modelo multimodal de grande escala Mech-GPT, que aceita comandos em linguagem natural e imagens, possuindo capacidades de compreensão e raciocínio semelhantes às humanas; e a mão hábil Mech-Hand, centrada no Modelo de Ação Mundial (World Action Model), capaz de realizar operações delicadas como agarrar, torcer, pegar e segurar.
Fundada em 2016, a Mech-Mind Robotics há muito se concentra na capacidade de visão e operação robótica. O fundador da empresa, Shao Tianlan, acredita que a indústria de inteligência incorporada deve seguir o conceito de "inteligência maior que forma", ou seja, o "olho-cérebro-mão" como um componente padrão pode ser usado em diferentes corpos robóticos, enquanto diferentes tarefas exigem diferentes formas físicas. Atualmente, os produtos da empresa foram implantados globalmente em mais de 27.000 unidades, atendendo a mais de 100 clientes da Fortune 500, mantendo a maior participação de mercado em seu segmento doméstico por seis anos consecutivos (2020-2025), e possui subsidiárias e equipes nos Estados Unidos, Japão, Coreia do Sul, Alemanha e outros locais.











