Publicado 03/08/2026 13:35

O Gemini Robotics 2 permite o controle inteligente de todo o corpo, destreza avançada e colaboração entre robôs

Robô humanóide com o Gemin Robotics 2.
GOOGLE

MADRID 3 ago. (Portaltic/EP) -

O Google avança na área da robótica com seu novo modelo mais avançado de visão, linguagem e ação, o Gemini Robotics 2, que traz melhorias para ampliar o controle inteligente dos movimentos a todo o corpo, destreza avançada na execução de tarefas e colaboração entre vários robôs.

A gigante da tecnologia revelou a nova camada de inteligência que impulsionará a próxima geração de robôs “verdadeiramente adaptáveis”, já que eles serão capazes de raciocinar sobre cada movimento, “abrindo caminho para uma ampla gama de tarefas”.

Nesse sentido, os avanços do modelo Gemini Robotics 2 se destacam por permitir que os robôs humanóides realizem ações como andar, agachar-se, esticar-se e manipular objetos com destreza para, por exemplo, arrumar um quarto.

Isso se deve ao fato de que, enquanto os modelos anteriores controlavam apenas a parte superior do corpo do humanóide para realizar tarefas sobre uma mesa, o Gemini Robotics 2 amplia a IA física aos movimentos de todo o corpo.

“Pela primeira vez, o modelo é capaz de controlar robôs humanóides completos, traduzindo a intenção em um controle inteligente de todo o corpo”, esclareceu o Google.

Além disso, foi introduzida a capacidade de colaborar com outros robôs de forma inteligente para se organizar e concluir as tarefas mais rapidamente, conforme explicou o Google em um comunicado em seu blog.

Da mesma forma, essa inteligência avançada foi projetada para ser executada localmente no dispositivo, podendo se adaptar a diferentes corpos robóticos “completamente novos” em “apenas algumas horas”.

INTELIGÊNCIA ROBÓTICA COM TRÊS MODELOS

Para poder executar todas essas capacidades, o Gemini Robotics 2 utiliza três modelos de grande capacidade. Por um lado, o já mencionado modelo de visão, linguagem e ação (VLA), que converte as informações visuais e linguísticas em controle motor, permitindo que o robô realize ações.

Esse modelo influencia o controle dos humanóides em sua totalidade, dos dedos dos pés até os das mãos. Além disso, oferece um novo nível de manipulação precisa tanto nas mãos quanto para aqueles que utilizam pinças.

Por sua vez, o modelo Gemini Robotics ER 2 é o modelo de raciocínio integrado mais avançado. Esse modelo é de linguagem visual e atua como um agente, permitindo que os robôs se comuniquem com os humanos, compreendam o mundo físico e planejem tarefas de várias etapas.

Por fim, o modelo Gemini Robotics On-Device 2 é o modelo de visão, linguagem e ação (VLA) mais eficiente, neste caso, otimizado para ser executado localmente nos dispositivos robóticos.

TAREAS CORPORAIS COMPLETAS E MAIS PRECISAS

Como resultado de tudo isso, os usuários poderão pedir aos robôs humanóides que realizem ações específicas, como colocar um regador na caixa verde da prateleira inferior. Em seguida, o robô processará a instrução e se deslocará pelo espaço realizando a tarefa de forma inteligente, raciocinando sobre seus movimentos e ações com todo o corpo.

Outro avanço é que o modelo agora pode controlar mãos SharpaWave de cinco dedos e 22 graus de liberdade para realizar ações delicadas, como dar nós. Ele também pode operar pinças paralelas padrão de dois dedos para realizar tarefas complexas que exigem destreza.

Por fim, o modelo Gemini Robotics ER 2 atua como “o cérebro de alto nível do robô”, processando as instruções e se comunicando com os humanos. Ele observa o ambiente, raciocina sobre as etapas necessárias para concluir a tarefa, coordena-se com o VLA para executar as ações e acompanha o progresso até que a tarefa seja concluída. Agora, os robôs são capazes de entender quando as tarefas começam e terminam.

Além de tudo isso, esse modelo foi desenvolvido com uma abordagem de segurança em várias camadas, combinando estruturas sólidas de segurança em IA e introduzindo uma nova métrica chamada ASIMOV-Agentic para IA física agênica e navegação em ambientes de incerteza.

O Google informou que o Gemini Robotics ER 2 já está disponível no Google AI Studio e em versão prévia privada na Gemini Enterprise Agent Platform. Da mesma forma, os modelos VLA e On-Device estão disponíveis apenas para parceiros com acesso antecipado.

Esta notícia foi traduzida por um tradutor automático

Contador

Contenido patrocinado