Esta página foi traduzida automaticamente do inglês. Visualize o original em inglês.

Robôs, engenheiros de controle e pesquisadores de inferência ativa avaliando se arquiteturas unificadas de percepção-ação-aprendizagem podem superar ou complementar o controle e o aprendizado por reforço clássicos.

Inferência Ativa e Robótica

Robôs como percepções e agentes incorporados, limitados pela incerteza — um laboratório natural para a minimização de energia esperada.

Melhores ações seguintes

Passeio sobre Inferência Ativa e Robótica

Comece com os links públicos de maior sinal desta página, depois continue através das visualizações de recursos e diretórios relacionados.

Robôs continuamente percebem, agem e aprendem sob incerteza usando sensores ruidosos e multimodais e atuadores imperfeitos — precisamente as condições que o princípio da energia livre foi formulado para descrever. Uma literatura crescente, mas ainda heterogênea, explorou a inferência ativa como uma forma de unificar a estimação de estado, controle, planejamento e aprendizado de modelo em sistemas robóticos, abrangendo artigos teóricos, provas de conceito simuladas e experimentos em humanoides físicos e manipuladores. Esta página sintetiza os padrões de aplicação dessa literatura, ferramentas e laboratórios nomeados e os problemas abertos que separam demonstrações convincentes de uma metodologia de engenharia rotineira implantada.

Por que o domínio se encaixa

A inferência ativa separa a estimativa de estado (filtros de Kalman/partículas), o controle (LQR, MPC, PID) e, cada vez mais, o aprendizado por reforço, cada um resolvido como um módulo separado. A inferência ativa, em vez disso, considera que os três são inferência bayesiana aproximada sob um único modelo gerador, minimizando a energia variacional livre para percepção e aprendizagem e a energia livre esperada — que troca valor epistémico (ganho de informação) e prático (satisfação da meta) para a seleção de ações. Os autores de Lanillos et al. argumentam que esta unificação conceptual é exatamente o que torna os robôs plataformas ideais de teste: eles devem manter crenças sobre variáveis ocultas (configuração do corpo, estados dos objetos, dinâmica) a partir de fluxos de sensores ambíguos e agir para manter as observações dentro da faixa esperada do seu modelo. A análise de Millidge et al. sobre a literatura de controle como inferência mostra que, sob certas suposições, as políticas de inferência ativa reduzem-se a soluções de controle ótimo ou RL padrão, esclarecendo como os controladores existentes podem ser lidos como casos especiais da minimização da energia livre.

Padrões de aplicação na literatura

Modelos generativos em implementações robóticas são tipicamente estruturados em torno da física e cinemática conhecidas, em vez de aprendizado end-to-end: o trabalho de percepção do corpo humanoide codifica a cinemática direta e modelos de observação multissensoriais (visual/proprioceptivos), enquanto os controladores de manipuladores codificam dinâmica das articulações, inércia e forças de contato. A energia livre esperada então impulsiona a seleção da política — o controlador adaptativo do manipulador publicado pela IEEE Robotics and Automation Letters por Pezzato, Ferrari e Hernández adapta-se online à incerteza dinâmica e falhas nos sensores, e o agente de equilíbrio de bola de Baioumy et al. mostra energia livre esperada induzindo comportamento genuinamente exploratório, como curiosidade. Ponderação precisa — ajustar a confiança em canais sensoriais ou precedentes com base na confiabilidade inferida — se repete neste trabalho, notavelmente no esquema de resíduos beta do grupo de Ferrari para detectar e compensar sensores defeituosos. Arquiteturas hierárquicas multi-nível são discutidas conceitualmente (por exemplo, preferências no espaço de tarefa sobre ações no espaço de articulação) mas implementações hierárquicas concretas permanecem raras e em grande parte confinadas à simulação.

Projetos e ferramentas-chave

pymdp é a biblioteca de software geral e nomeada do relatório, um pacote Python de código aberto para inferência ativa em estados discretos (POMDP) introduzido através de um tutorial passo a passo indexado no PubMed. O grupo de Riccardo Ferrari na Universidade de Tecnologia de Delft produziu o corpo de trabalho mais sustentado de manipulador-controle — o controlador adaptativo, estimativa de estado/controle/aprendizagem integrada (ICRA 2021), inferência ativa não enviesada para controle clássico (IROS 2022) e tolerância a falhas residual beta — com código referenciado em seu site de pesquisa. Pablo Lanillos e colaboradores (TU Munique e parceiros baseados no Japão) lideram a linha humanaide: percepção corporal e alcance em um humanoide físico, e distinção espelho auto/outro combinando inferência ativa com modelos forward de redes neurais. O Laboratório de Robótica de Bristol e o Laboratório de Toque Ativo contribuem para sistemas de exploração tátil Bayesianos ativos (arrays de pontas dos dedos, bigodes) que emanam princípios de inferência ativa sem sempre formalizá-los como tal, e a publicação do blog Verses AI sinaliza interesse industrial precoce, embora não seja explicitamente revisada por pares.

Problemas em aberto

O relatório identifica cinco áreas não resolvidas que necessitam de mais evidências: escalabilidade da avaliação de energia livre esperada para robôs de alta dimensão e tempo real (abordada apenas em simulação até agora pelo preprint "Escalonamento da inferência ativa"); especificação de modelos generativos principados que equilibram física criada manualmente com componentes aprendidos; benchmarking sistemático entre-olhos contra controladores clássicos e aprendizado por reforço profundo, para o qual nenhuma suíte de benchmark padronizada (análoga às suítes de RL do estilo MuJoCo) ainda existe; segurança e robustez sob mudanças distributivas, onde o framework DR-FREE da Zorzi et al. (robustez da minimização da energia livre sobre um conjunto de ambiguidade de modelos) é proposto, mas ainda não aplicado a robôs físicos; e adoção institucional, já que as ferramentas de inferência ativa são muito menos maduras do que os stacks ROS ou de aprendizado profundo. O relatório adverte explicitamente que muitas alegações se baseiam em resultados qualitativos ou de prova de conceito, em vez de comparações sistemáticas.

Eixo de Referência

Christopher L. Buckley, Chang Sub Kim, Simon McGregor, Anil K. Seth (2017). The free energy principle for action and perception: A mathematical review. Journal of Mathematical Psychology. DOI: 10.1016/j.jmp.2017.09.004. Thomas Parr, Giovanni Pezzulo, Karl J. Friston (2022). Active Inference: The Free Energy Principle in Mind, Brain, and Behavior. MIT Press. Giovanni Pezzulo, Francesco Rigoli, Karl J. Friston (2017). Active Inference, homeostatic regulation and adaptive behavioural control. Progress in Neurobiology. DOI: 10.1016/j.pneurobio.2017.08.001. Pablo Lanillos, Cristian Meo, Corrado Pezzato, et al. (2021). Active Inference in Robotics and Artificial Agents: Survey and Challenges. arXiv. DOI: 10.48550/arXiv.2112.01871. Lancelot Da Costa, Thomas Parr, Noor Sajid, Sebastijan Veselic, Victorita Neacsu, Karl J. Friston (2020). Active inference on discrete state-spaces: A synthesis. Journal of Mathematical Psychology. DOI: 10.1016/j.jmp.2020.102447.

Superfícies-chave

Active Inference e Robótica em poucas palavras

Loop de inferência unificada

A inferência ativa reformula a estimativa de estado, o controle e a aprendizagem como uma única minimização de energia livre variacional sob um modelo generativo único, em vez de módulos separados e manualmente ajustados.

Tolerância a falhas ponderada em precisão

Aprendizagem de precisão residual beta permite que os controladores de manipuladores diminuam o peso de canais de sensores não confiáveis em tempo real, mantendo o desempenho sob falhas nos sensores.

Evidências de qualidade mistas

Os resultados abrangem trabalhos publicados em periódicos revisados por pares (IEEE RAL, tutoriais indexados no PubMed) e pré-impressões ou artigos de blogs da indústria não revisados (Verses AI), sem que ainda exista uma suíte de benchmarks padronizada para comparar a inferência ativa com o controle clássico ou o RL.

Recursos relacionados

Links públicos para esta página

Os links externos são resolvidos a partir do registro compartilhado, mantendo assim os destinos visíveis ao visitante centralizados e verificáveis.

Repository / Projects

GitHub organization

Audience: Developer

Public GitHub organization for Institute repositories and open-source work.

projectsgithub-org