Toyota está ensinando robôs a preparar o café da manhã com IA

A Toyota está usando IA e o sentido de tato para treinar robôs a realizar tarefas complexas, na busca pelos Grandes Modelos de Comportamento
Ana Luiza Figueiredo19/09/2023 20h59, atualizada em 20/09/2023 20h54
Compartilhe esta matéria
Ícone Whatsapp Ícone Whatsapp Ícone X (Tweeter) Ícone Facebook Ícone Linkedin Ícone Telegram Ícone Email

Siga o Olhar Digital no Google Discover

O Toyota Research Institute (TRI) está revolucionando a maneira como os robôs aprendem a realizar tarefas complexas, como preparar o café da manhã, por meio do uso da inteligência artificial (IA), como mostra um vídeo divulgado pela empresa para demonstrar a técnica inovadora de treinamento.

Ofertas

Material Dourado Com 74 Peças Pais & Filhos Dourado
Vendido por Amazon
Material Dourado Com 74 Peças Pais & Filhos Dourado
De: R$ 11,85
Por: R$ 8,28
Ar-Condicionado Split HW Elgin Eco Inverter II Wi-Fi 12.000 BTUs R-32 Quente/Frio 220V
Vendido por Amazon
Ar-Condicionado Split HW Elgin Eco Inverter II Wi-Fi 12.000 BTUs R-32 Quente/Frio 220V
De: R$ 2.499,00
Por: R$ 1.998,89
Freezer Vertical Consul 231 Litros - CVU26FB 110V
Vendido por Amazon
Freezer Vertical Consul 231 Litros - CVU26FB 110V
De: R$ 3.279,35
Por: R$ 2.498,89
WAP Ventilador de Torre AIR SILENCE com 4 Ní­veis de Velocidade, Time de até 15 Horas e Desligamento Automático 127V
Vendido por Amazon
WAP Ventilador de Torre AIR SILENCE com 4 Ní­veis de Velocidade, Time de até 15 Horas e Desligamento Automático 127V
De: R$ 599,90
Por: R$ 404,90
MONDIAL Ventilador de Mesa 40cm Super Power, Branco/Azul, 140W, 110V - VSP-40-W
Vendido por Amazon
MONDIAL Ventilador de Mesa 40cm Super Power, Branco/Azul, 140W, 110V - VSP-40-W
De: R$ 189,90
Por: R$ 129,90
Climatizador de Ar Digital Midea 127V 60Hz
Vendido por Amazon
Climatizador de Ar Digital Midea 127V 60Hz
De: R$ 529,99
Por: R$ 412,69
Monitor Gamer IPS 24 Polegadas, Full HD, 180Hz, 1ms, HDR400, G-SYNC, 250cd/m², Alto-falantes embutidos, Entradas HDMI/DisplayPort/USB/3.5mm
Vendido por Amazon
Monitor Gamer IPS 24 Polegadas, Full HD, 180Hz, 1ms, HDR400, G-SYNC, 250cd/m², Alto-falantes embutidos, Entradas HDMI/DisplayPort/USB/3.5mm
De: R$ 799,00
Por: R$ 593,00
Câmera Digital EOS, Canon, Preto, 23 x 14 x 17 cm
Vendido por Amazon
Câmera Digital EOS, Canon, Preto, 23 x 14 x 17 cm
De: R$ 3.799,00
Por: R$ 3.598,94
Câmera digital, vídeo de 5k, câmera de 75 megapixels, transmissão Wi-Fi, foco automático, zoom digital de 18x, tela giratória de 180 graus, cartão SD de 32G,câmera compacta,vlog,fotográfica
Vendido por Amazon
Câmera digital, vídeo de 5k, câmera de 75 megapixels, transmissão Wi-Fi, foco automático, zoom digital de 18x, tela giratória de 180 graus, cartão SD de 32G,câmera compacta,vlog,fotográfica
De: R$ 699,00
Por: R$ 499,00
PlayStation DualSense Controle sem fio – Branco
Vendido por Amazon
PlayStation DualSense Controle sem fio – Branco
De: R$ 499,90
Por: R$ 369,00
Robô Aspirador Liectroux XR500 Pro 3 em 1 Aspira Varre Passa Pano Com Aplicativo Compatível Com Alexa e Google Mapeamento Inteligente Salva os Mapas Bivolt
Vendido por Amazon
Robô Aspirador Liectroux XR500 Pro 3 em 1 Aspira Varre Passa Pano Com Aplicativo Compatível Com Alexa e Google Mapeamento Inteligente Salva os Mapas Bivolt
De: R$ 2.489,00
Por: R$ 1.616,02
MONDIAL Ventilador de Parede 40cm Super Turbo 8 Pás, Preto/Prata, 140W, 110V - VTX-40P-8P
Vendido por Amazon
MONDIAL Ventilador de Parede 40cm Super Turbo 8 Pás, Preto/Prata, 140W, 110V - VTX-40P-8P
De: R$ 259,90
Por: R$ 179,90
Notebook ASUS Vivobook 15 X1504VA Intel Core i5 1334U 8GB Ram 512GB SSD Windows 11 Tela 15,6" FHD Silver - NJ1740W
Vendido por Amazon
Notebook ASUS Vivobook 15 X1504VA Intel Core i5 1334U 8GB Ram 512GB SSD Windows 11 Tela 15,6" FHD Silver - NJ1740W
De: R$ 3.599,00
Por: R$ 2.759,00
Fritadeira Sem Óleo Air Fryer Eos Chef Gourmet 6.2 Litros Compacta Digital Vermelho Eaf60v 110v
Vendido por Amazon
Fritadeira Sem Óleo Air Fryer Eos Chef Gourmet 6.2 Litros Compacta Digital Vermelho Eaf60v 110v
De: R$ 299,90
Por: R$ 199,00
soundcore P20i da Anker Fone de Ouvido Sem Fio, Drivers de 10mm, Graves Potentes, Bluetooth 5.3, 30H de Bateria, Resistência à Água, 2 Microfones IA, App Personalizável
Vendido por Amazon
soundcore P20i da Anker Fone de Ouvido Sem Fio, Drivers de 10mm, Graves Potentes, Bluetooth 5.3, 30H de Bateria, Resistência à Água, 2 Microfones IA, App Personalizável
De: R$ 249,00
Por: R$ 166,19
Philips Walita Preta Fritadeira Airfryer Essential XL Digital, 6.2L de capacidade, Garantia internacional de dois anos, 110V, 2000W (RI9270/90)
Vendido por Amazon
Philips Walita Preta Fritadeira Airfryer Essential XL Digital, 6.2L de capacidade, Garantia internacional de dois anos, 110V, 2000W (RI9270/90)
De: R$ 899,90
Por: R$ 399,00
WAP Umidificador de Ar AIR FLOW com Luminária e Difusor de Aromas, 4 Litros, Autonomia de até 12 horas, 20W Bivolt
Vendido por Amazon
WAP Umidificador de Ar AIR FLOW com Luminária e Difusor de Aromas, 4 Litros, Autonomia de até 12 horas, 20W Bivolt
De: R$ 229,90
Por: R$ 132,00
CAMERA INSTAX MINI 12 ROSA GLOSS
Vendido por Amazon
CAMERA INSTAX MINI 12 ROSA GLOSS
De: R$ 649,00
Por: R$ 505,00

Em um ambiente que eles descrevem como uma “jardim de infância para robôs”, pesquisadores da TRI estão implementando técnicas que prometem eliminar a necessidade de centenas de horas de programação complexa e resolução de erros e bugs.

Leia mais:

A chave para o sucesso desse processo é proporcionar aos robôs um sentido de tato. Ao dotá-los de uma espécie de “polegar macio”, os robôs podem “sentir” o que estão fazendo, o que fornece informações cruciais para a execução de tarefas difíceis que seriam desafiadoras de serem realizadas apenas com base na visão.

É emocionante vê-los interagindo com o ambiente ao seu redor.

Ben Burchfiel, gerente de manipulação habilidosa do Toyota Research Institute

O processo começa com um “professor” humano que demonstra uma série de habilidades aos robôs. Em seguida, ao longo de algumas horas, o modelo de IA aprende essas habilidades em segundo plano. Burchfiel acrescenta que “é comum para nós ensinarmos um robô à tarde, permitir que ele aprenda durante a noite e, na manhã seguinte, nos depararmos com um novo comportamento funcional”.

Os pesquisadores estão empenhados em criar “Grandes Modelos de Comportamento” ou LBCs (Large Behavior Models, em inglês) para os robôs. Esses modelos, semelhantes aos Grandes Modelos de Linguagem, também chamados de LLMs (Large Language Models, em inglês) usados para gerar texto humano, aprenderiam por observação e seriam capazes de realizar novas tarefas que nunca foram explicitamente ensinadas.

Russ Tedrake, professor de robótica do MIT e vice-presidente de pesquisa em robótica da TRI, explica que essa abordagem é revolucionária no campo da robótica. Usando esse processo, os pesquisadores afirmam ter treinado com sucesso mais de 60 habilidades desafiadoras, incluindo “derramar líquidos, usar ferramentas e manipular objetos deformáveis”. Eles têm como meta aumentar esse número para 1.000 até o final de 2024.

É importante notar que outras empresas de tecnologia, como o Google e a Tesla, também estão explorando abordagens semelhantes. Assim como os pesquisadores da Toyota, seus robôs usam a experiência adquirida para inferir como realizar tarefas.

Teoricamente, robôs treinados por IA poderiam, no futuro, executar tarefas com pouca ou nenhuma instrução, semelhante à orientação que se daria a um ser humano (“limpe esse derramamento”, por exemplo).

Principais conquistas

toyota
Imagem: Toyota Research Institute / Divulgação

O Toyota Research Institute descreve as maiores conquistas de seu trabalho para desenvolvimento dos Grandes Modelos de Comportamento como as seguintes:

  • Política de Difusão: TRI e colaboradores no grupo do Professor Song na Universidade de Columbia desenvolveram uma nova abordagem poderosa de aprendizado de comportamento baseada em IA generativa, chamada de “Política de Difusão”, que permite o ensino rápido e fácil de comportamentos por meio de demonstrações.
  • Plataforma de Robô Personalizada: A plataforma de robô do TRI é projetada sob medida para tarefas de manipulação dúctil de braços duplos, com foco especial na capacidade de feedback háptico e sensor tátil.
  • Pipeline: Os robôs do TRI já aprenderam 60 habilidades dúcteis, com uma meta de centenas até o final do ano e 1.000 até o final de 2024.
  • Drake: Parte do “segredo não tão secreto” do instituto de pesquisa da Toyota é o Drake, um design baseado em modelo para robótica que fornece uma ferramenta avançada e uma plataforma de simulação. A alta fidelidade do Drake permite desenvolver em simulação e na realidade em uma escala e velocidade dramaticamente aumentadas. A pilha de robô interna é construída usando as estruturas de otimização e sistemas do Drake. O TRI disponibiliza o Drake como código aberto para estimular o trabalho em toda a comunidade de robótica.
  • Segurança: A segurança é fundamental nos esforços de robótica no TRI. O instituto projetou o sistema com salvaguardas sólidas, alimentadas pelo Drake e pela pilha de controle de robô personalizada, para garantir que os robôs respeitem garantias de segurança, como evitar colisões com eles mesmos ou com o ambiente.

Muito trabalho pela frente

  • No entanto, como observou o The New York Times ao abordar a pesquisa da Google, esse tipo de trabalho costuma ser “lento e trabalhoso”.
  • Fornecer dados de treinamento suficientes é muito mais desafiador do que simplesmente alimentar um modelo de IA com uma grande quantidade de dados da internet.
  • O artigo do NYT destaca um exemplo em que um robô identificou erroneamente a cor de uma banana como sendo branca.
  • Isso ilustra os desafios que ainda enfrentam no desenvolvimento desses sistemas avançados de IA.
  • No entanto, o avanço na capacidade dos robôs de aprenderem por meio da experiência e da observação promete revolucionar a automação de tarefas complexas, tornando-a mais acessível e eficaz do que nunca.
  • A pesquisa da Toyota e de outras empresas nesse campo continua a moldar o futuro da robótica e da inteligência artificial.

Já assistiu aos novos vídeos no YouTube do Olhar Digital? Inscreva-se no canal!

Ana Luiza Figueiredo é repórter do Olhar Digital. Formada em Jornalismo pela Universidade Federal de Uberlândia (UFU), foi Roteirista na Blues Content, criando conteúdos para TV e internet.