
Google DeepMind apresenta IA para robôs e amplia avanços na robótica
A Google DeepMind apresentou uma inovação com a proposta de ampliar as capacidades de robôs em diferentes aplicações.
A novidade representa uma mudança em relação à abordagem tradicional, na qual o software precisava ser adaptado para cada robô.
Com o Gemini Robotics 2, o sistema passa a converter comandos de texto e imagem em movimentos precisos, permitindo que robôs andem, agachem, estiquem e manipulem objetos complexos.
Essa convergência entre modelos de linguagem e o mundo físico pode representar um novo passo na evolução da robótica baseada em IA.
O que é o Google DeepMind?
Fachada do escritório da Google DeepMind em Londres, centro de pesquisas do Gemini Robotics 2. (Foto: Alamy/PA)
O Google DeepMind é o laboratório avançado de pesquisa em inteligência artificial da Alphabet, responsável pelo desenvolvimento de sistemas como AlphaGo, Gemini e modelos pioneiros em robótica autônoma.
Fundada com o objetivo de criar inteligência artificial geral (AGI), a divisão atua na fronteira científica para resolver problemas complexos na ciência e na indústria.
No campo da robótica, a organização busca criar modelos de fundação capazes de generalizar aprendizados para diferentes tipos de hardware.
Sua abordagem mais recente combina entendimento multimodal de dados com geração direta de trajetória e controle de força para braços mecânicos e humanoides.
Quando o Google comprou a DeepMind?
O Google adquiriu a DeepMind no início de 2014, fortalecendo sua posição estratégica na corrida global pelo desenvolvimento de inteligência artificial avançada.
A integração uniu a capacidade computacional massiva do ecossistema Google ao time de pesquisadores focados em aprendizado por reforço da startup britânica.
Anos mais tarde, o Google fundiu a equipe com o Google Brain, consolidando a marca oficial Google DeepMind para liderar seus projetos mais ambiciosos.
A aquisição é frequentemente apontada como um marco importante para o desenvolvimento das tecnologias de IA que mais tarde deram origem à família de modelos Gemini e a aplicações em robótica.
Conteúdo recomendado: Conheça as tecnologias de robótica aplicadas à reabilitação motora.
Como acessar as ferramentas da Google DeepMind?
A utilização das ferramentas de IA da Google DeepMind para desenvolvimento e testes ocorre principalmente por meio de plataformas voltadas a desenvolvedores e empresas.
Os modelos Gemini podem ser acessados por serviços como o Google AI Studio e a plataforma de nuvem Vertex AI, que oferecem recursos para criação, testes e integração de aplicações de inteligência artificial.
O Google AI Studio permite criar uma conta e gerar uma chave de API (API Key) para conectar projetos aos modelos Gemini.
Já a documentação oficial reúne bibliotecas, exemplos de código e orientações para integrar recursos de linguagem, visão computacional e planejamento de tarefas.
Alguns recursos mais avançados, especialmente os relacionados ao controle de robôs e à robótica, continuam sendo disponibilizados gradualmente para parceiros credenciados.
Como funciona o Gemini Robotics 2?
O robô humanoide Apollo 2, da Apptronik, retira uma luva de beisebol da prateleira usando os modelos de IA da Google DeepMind. (Foto: Divulgação/Google)
A solução desenvolvida pela Google DeepMind divide a inteligência robótica em três camadas funcionais com responsabilidades bem definidas na arquitetura.
O modelo Gemini Robotics 2 atua na conversão direta de visão e comandos em controle motor para humanoides e garras industriais.
Já o Gemini Robotics ER 2 assume o raciocínio complexo, interpretando o ambiente, conversando com operadores e dividindo tarefas longas em etapas.
Por fim, o Gemini Robotics On Device 2 executa decisões localmente no próprio robô, garantindo baixíssima latência e operação sem dependência de conexão com a nuvem.
Como o Gemini Robotics 2 se saiu nos testes?
Nos testes divulgados pela Google DeepMind, o sistema alcançou 89,6% de taxa de sucesso em tarefas de inserção precisa e 78,9% na montagem de kits com ferramentas diversas.
O modelo operou tarefas reais como amarrar sacos de lixo, fechar embalagens e organizar ferramentas, além de coordenar o humanoide Apptronik Apollo 2.
Apesar dos avanços, a Google DeepMind reconheceu que a manipulação fina com múltiplos dedos continua sendo um desafio e que a velocidade dos movimentos precisa evoluir.
Segundo a Google DeepMind, são necessários menos de 200 exemplos práticos para ensinar o modelo a controlar uma nova plataforma robótica.
Como a Google DeepMind busca garantir a segurança dos robôs?
Para garantir operações seguras, a Google DeepMind apresentou o ASIMOV Agentic, um benchmark focado em avaliar a segurança de agentes autônomos.
A estrutura avalia se o robô recusa chamadas inseguras, reconhece tarefas impossíveis e solicita intervenção humana diante de incertezas no ambiente.
Segundo a empresa, o modelo ER 2 inclui detecção de proximidade de pessoas para acionar paradas de emergência preventivas em linhas de montagem.
Mesmo com esses mecanismos, a segurança em ambientes industriais continua dependendo de procedimentos operacionais, barreiras físicas e supervisão humana.
Perguntas frequentes sobre Google DeepMind
O que faz o Gemini Robotics 2 da Google DeepMind?
É um modelo de visão, linguagem e ação que transforma prompts e dados visuais em trajetórias motoras e controle de força para robôs.
O Gemini Robotics 2 já está disponível para uso geral?
A camada de raciocínio (ER 2) pode ser testada no Google AI Studio, enquanto os modelos de controle motor local estão em fase de testes fechados com parceiros.
Por que rodar o modelo localmente no robô é importante?
A execução On Device reduz a latência de decisão, protege dados sensíveis da operação e mantém o equipamento funcionando em locais sem internet estável.
O Gemini Robotics 2 substitui programadores de robôs?
Não. O modelo pode reduzir parte do trabalho de programação manual, mas ainda depende de configuração, supervisão, integração com hardware e validação por profissionais especializados.
Conclusão
A apresentação do Gemini Robotics 2 mostra como a inteligência artificial vem ampliando as capacidades da robótica em diferentes setores.
Embora a tecnologia ainda apresente desafios relacionados à segurança, à confiabilidade e à adoção em larga escala, ela indica uma tendência de maior integração entre software e hardware nos próximos anos.
À medida que essas tecnologias evoluem, será importante acompanhar tanto seus avanços quanto os desafios relacionados à segurança, à confiabilidade e ao uso responsável da inteligência artificial na robótica.
Quer continuar explorando o mundo da robótica? Leia Cão-robô: entenda como funciona e onde é usada essa tecnologia para descobrir como a inteligência artificial está ganhando quatro patas na indústria e na segurança.
