Categorias: Mercado de tecnologia e TI. notíciaO mundo da robótica

O Google criou e demonstrou na prática uma IA que faz os robôs pensarem primeiro e depois agirem.

O Google DeepMind revelou dois novos modelos de inteligência artificial (IA) para robótica, o Gemini Robotics 1.5 e o Gemini Robotics-ER 1.5, que juntos implementam uma abordagem na qual um robô primeiro “pensa” em uma tarefa e só então a executa. A tecnologia é baseada em sistemas de IA generativa e foi projetada para superar as limitações dos robôs atuais, que exigem ampla personalização para cada tarefa específica.

Fonte da imagem: Google

Sistemas de IA generativa capazes de criar texto, imagens, áudio e até vídeo estão se tornando cada vez mais comuns. Assim como esses modelos geram esses tipos de dados, eles também podem gerar sequências de ações para robôs. Esse é o princípio por trás do projeto Gemini Robotics, do Google DeepMind, que anunciou dois modelos complementares que permitem aos robôs “pensar” antes de agir. Embora os modelos de linguagem em larga escala (LLMs) tradicionais apresentem diversas limitações, a introdução do raciocínio simulado expandiu significativamente suas capacidades, e um avanço semelhante pode ocorrer agora na robótica.

A equipe do Google DeepMind acredita que a IA generativa tem o potencial de revolucionar a robótica, fornecendo aos robôs funcionalidades de uso geral. Ao contrário dos sistemas atuais, que exigem meses de ajustes para uma única tarefa altamente especializada e são pouco adaptáveis a novas condições, as novas abordagens de IA permitem que os robôs operem em ambientes desconhecidos sem necessidade de reprogramação. Como observou Carolina Parada, chefe de robótica da DeepMind, os robôs atuais são “extremamente especializados e difíceis de implementar”.

Para implementar esse conceito, a DeepMind desenvolveu o Gemini Robotics-ER 1.5 e o Gemini Robotics 1.5. O primeiro é um modelo de visão-linguagem (VLM) com raciocínio incorporado que analisa dados visuais e textuais, gera um plano de tarefas passo a passo e pode incorporar ferramentas externas, como a busca do Google, para contextualizar. O segundo é um modelo de visão-linguagem-ação (VLA), queEle converte instruções recebidas em ações físicas para o robô, ajustando-as simultaneamente com base no feedback visual e em seu próprio processo de “pensamento” para cada etapa. De acordo com Kanishka Rao, da DeepMind, o principal avanço foi dar ao robô a capacidade de imitar o raciocínio intuitivo humano — ou seja, pensar antes de agir.

Os desenvolvedores demonstraram como os novos modelos funcionam: um vídeo de um robô humanoide, o Apollo, equipado com o Gemini Robotics 1.5, fazendo as malas para uma viagem, enquanto outro robô, o Aloha 2 — ou melhor, um par de braços robóticos — separa o lixo.

Ambos os modelos são baseados na arquitetura fundamental do Gemini, mas são treinados adicionalmente usando dados que refletem interações com o mundo físico. Isso permite que os robôs executem tarefas complexas em várias etapas, aproximando-os do nível de agentes autônomos. O sistema também demonstra compatibilidade entre plataformas. Em particular, as habilidades incorporadas em um robô, como o Aloha 2 de dois braços, podem ser transferidas para outro, incluindo o humanoide Apollo, sem personalização adicional.

Apesar do potencial avanço tecnológico, as aplicações práticas da tecnologia ainda são limitadas. O modelo Gemini Robotics 1.5, que controla os robôs, está disponível apenas para testadores confiáveis. Enquanto isso, o Gemini Robotics-ER 1.5 já foi integrado ao Google AI Studio, permitindo que desenvolvedores gerem instruções para seus próprios experimentos com robôs fisicamente incorporados. No entanto, de acordo com Ryan Whitwam, da Ars Technica, ainda há um longo caminho a percorrer antes do advento de robôs de consumo capazes de realizar tarefas cotidianas.caminho.

admin

Próximo A Apple não viu problema em anunciar recursos de inteligência artificial da Siri que nunca se materializaram. »

Anterior « A Asus dará uma placa de vídeo GeForce RTX 5090 ROG Astral autografada por Huang para o melhor design de placa de vídeo.

Deixar comentário

Publicado por

admin

9 meses atrás

Postagens recentes

Sistemas operacionais

OxygenOS e Realme UI serão relegados ao passado – OnePlus e Realme migrarão para o ColorOS.

O OxygenOS e a Realme UI não serão mais usados nos novos modelos de smartphones…

24 minutos atrás

Desenvolvimento e fabricação de eletrônicos

IFixit criará um padrão unificado para a reparabilidade de eletrônicos nos EUA.

A iFixit, em parceria com a NSF, organização global independente de serviços, iniciou o desenvolvimento…

24 minutos atrás

Jogos

A Epic Games Store revelou os planos da Square Enix para expansões da história de Final Fantasy VII Revelation.

Embora a editora Square Enix já tenha dividido o remake do cultuado RPG japonês Final…

1 hora atrás

Jogos

Cyberpunk 2077 vendeu mais de 40 milhões de cópias nos cinco anos e meio desde o seu lançamento.

As vendas de Cyberpunk 2077 ultrapassaram 40 milhões de cópias, anunciaram os desenvolvedores do RPG…

1 hora atrás

Inteligência Artificial, Aprendizado de Máquina, Redes Neurais

A Alibaba proibiu seus funcionários de usar o assistente de programação Claude Code, da Anthropic.

Após a American Anthropic acusar a Alibaba, da China, de extrair, ou efetivamente roubar, dados…

1 hora atrás

Telefones celulares, smartphones, comunicações celulares, comunicadores, PDAs

A Xiaomi se orgulha de ter vendido 500 milhões de smartphones Redmi Note – e o novo Redmi Note 17 já está a caminho.

Nos últimos 12 anos, a Xiaomi vendeu meio bilhão de smartphones Redmi Note em todo…

1 hora atrás

O Google criou e demonstrou na prática uma IA que faz os robôs pensarem primeiro e depois agirem.

Conteúdo relacionado

Postagens recentes

OxygenOS e Realme UI serão relegados ao passado – OnePlus e Realme migrarão para o ColorOS.

IFixit criará um padrão unificado para a reparabilidade de eletrônicos nos EUA.

A Epic Games Store revelou os planos da Square Enix para expansões da história de Final Fantasy VII Revelation.

Cyberpunk 2077 vendeu mais de 40 milhões de cópias nos cinco anos e meio desde o seu lançamento.

A Alibaba proibiu seus funcionários de usar o assistente de programação Claude Code, da Anthropic.

A Xiaomi se orgulha de ter vendido 500 milhões de smartphones Redmi Note – e o novo Redmi Note 17 já está a caminho.