Questa pagina è stata tradotta automaticamente dall'inglese. Visualizza l'originale in inglese.

Robotici, ingegneri di controllo ed esperti di inferenza attiva valutano se architetture unificate percezione-azione-apprendimento possano superare o integrare il controllo e l'apprendimento per rinforzo classici.

Inferenza Attiva e Robotica

Robot come percepitori e attori incarnati, limitati dall'incertezza – un banco di prova naturale per la minimizzazione dell'energia attesa.

Migliori azioni successive

Percorso di Active Inference e Robotica

Inizia con i link pubblici più rilevanti di questa pagina, poi continua attraverso le viste delle risorse e delle directory correlate.

I robot percepiscono, agiscono e apprendono continuamente in condizioni di incertezza utilizzando sensori rumorosi e multimodali e attuatori imperfetti — precisamente le condizioni per cui è stata formulata la teoria del principio di energia libera. Una letteratura crescente ma ancora eterogenea ha esplorato l'inferenza attiva come un modo per unificare la stima dello stato, il controllo, la pianificazione e l'apprendimento dei modelli nei sistemi robotici, comprendendo articoli teorici, prove di concetto simulate ed esperimenti su umanoidi fisici e manipolatori. Questa pagina sintetizza i pattern di applicazione della letteratura, gli strumenti e i laboratori denominati e i problemi aperti che separano dimostrazioni convincenti da una metodologia ingegneristica utilizzata regolarmente.

Perché il dominio è adatto

L'ingegneria robotica classica separa la stima dello stato (filtri di Kalman/particella), il controllo (LQR, MPC, PID) e, sempre più, l'apprendimento per rinforzo, ciascuno risolto come un modulo separato. L'inferenza attiva invece considera le tre come inferenza bayesiana approssimata sotto un singolo modello generativo, minimizzando l'energia variazionale per la percezione e l'apprendimento e l'energia attesa — che scambia valore epistemic (guadagno informativo) e pragmatico (soddisfazione dell'obiettivo) per la selezione delle azioni. Lanillos e i suoi colleghi sostengono che questa unificazione concettuale è esattamente ciò che rende i robot dei testbed ideali: devono mantenere credenze su variabili nascoste (configurazione del corpo, stati degli oggetti, dinamiche) da flussi di dati sensoriali ambigui e agire per mantenere le osservazioni all'interno dell'intervallo atteso del loro modello. L'analisi di Millidge et al. sulla letteratura sul controllo come inferenza mostra inoltre che, sotto certe ipotesi, le politiche di inferenza attiva si riducono a soluzioni di controllo ottimali standard o RL, chiarendo come i controllori esistenti possano essere letti come casi speciali della minimizzazione dell'energia libera.

Patterni di applicazione nella letteratura

I modelli generativi nelle implementazioni robotiche sono tipicamente strutturati attorno alla fisica e alla cinematica note piuttosto che all'apprendimento end-to-end: il lavoro di percezione del corpo umanoide codifica la cinematica avanti e i modelli di osservazione multimodali (visiva/proprioceptive), mentre i controllori dei manipolatori codificano le dinamiche giuntive, l'inerzia e le forze di contatto. L'energia libera attesa guida la selezione della politica — il controller adattivo del manipolatore di Pezzato, Ferrari e Hernández (pubblicato in IEEE Robotics and Automation Letters) si adatta online all'incertezza dinamica e ai guasti dei sensori, e l’agente di equilibrio sulla palla di Baioumy et al. mostra un'energia libera attesa che induce un comportamento genuinamente esplorativo, simile alla curiosità. Il pesare preciso — regolare la fiducia nei canali sensoriali o nelle priorità in base all'affidabilità dedotta — si ripete in questo lavoro, in particolare nello schema dei residui beta del gruppo di Ferrari per rilevare e compensare i sensori difettosi. Le architetture gerarchiche multi-livello sono discusse concettualmente (ad esempio, preferenze dello spazio delle attività rispetto alle azioni nello spazio giuntivo) ma le implementazioni gerarchiche concrete rimangono rare e in gran parte confinate alla simulazione.

Progetti e strumenti chiave

pymdp è la libreria software generica a un nome del rapporto, un pacchetto Python open source per l’inferenza attiva a stati discreti (POMDP) introdotta tramite un tutorial passo dopo passo indicizzato su PubMed. Il gruppo di Riccardo Ferrari all'Università di Tecnologia di Delft ha prodotto il corpo di lavoro più sostenuto di controllo manipolatore — il controllore adattivo, stima/controllo/apprendimento dello stato integrato (ICRA 2021), inferenza attiva non distorta per il controllo classico (IROS 2022) e tolleranza agli errori residui beta — con codice referenziato sul suo sito di ricerca. Pablo Lanillos e i suoi collaboratori (TU Monaco e partner basati in Giappone) guidano la linea antropomorfa: percezione del corpo e raggiungimento su un umanoide fisico, e distinzione specchio sé/altro combinando l’inferenza attiva con modelli neurali forward. Bristol Robotics Lab e il Laboratorio di Tatto Attiva contribuiscono sistemi di esplorazione tattile basati su sensori Bayesian active-sensing (array di punte) e vibrisse che incarnano i principi dell’inferenza attiva senza sempre formalizzarli come tali, e un post del blog di Verses AI segnala un precoce interesse industriale, sebbene non sia esplicitamente sottoposto a revisione paritaria.

Problemi irrisolti

Il rapporto identifica cinque aree irrisolte che necessitano di ulteriori prove: la scalabilità della valutazione dell'energia libera attesa a robot ad alta dimensionalità e in tempo reale (affrontata finora solo in simulazione tramite il preprint "Scaling active inference"); una specifica di modelli generativi che bilanci fisica realizzata manualmente con componenti apprese; un benchmarking testa-contro-testa sistematico contro controllori classici e deep RL, per il quale non esiste ancora suite di benchmark standard (analoga alle suite RL di MuJoCo); la sicurezza e la robustezza in caso di spostamento distributivo, dove il framework DR-FREE di Zorzi et al. (robustizzazione della minimizzazione dell'energia libera su un insieme di modelli di ambiguità) è proposto ma non ancora applicato a robot fisici; e l’adozione istituzionale, poiché i toolchain di active inference sono molto meno maturi rispetto a ROS o stack di deep learning. Il rapporto mette esplicitamente in guardia che molte affermazioni si basano su risultati qualitativi o di prova di concetto piuttosto che su confronti sistematici.

Spina dorsale di riferimento

Christopher L. Buckley, Chang Sub Kim, Simon McGregor, Anil K. Seth (2017). The free energy principle for action and perception: A mathematical review. Journal of Mathematical Psychology. DOI: 10.1016/j.jmp.2017.09.004. Thomas Parr, Giovanni Pezzulo, Karl J. Friston (2022). Active Inference: The Free Energy Principle in Mind, Brain, and Behavior. MIT Press. Giovanni Pezzulo, Francesco Rigoli, Karl J. Friston (2017). Active Inference, homeostatic regulation and adaptive behavioural control. Progress in Neurobiology. DOI: 10.1016/j.pneurobio.2017.08.001. Pablo Lanillos, Cristian Meo, Corrado Pezzato, et al. (2021). Active Inference in Robotics and Artificial Agents: Survey and Challenges. arXiv. DOI: 10.48550/arXiv.2112.01871. Lancelot Da Costa, Thomas Parr, Noor Sajid, Sebastijan Veselic, Victorita Neacsu, Karl J. Friston (2020). Active inference on discrete state-spaces: A synthesis. Journal of Mathematical Psychology. DOI: 10.1016/j.jmp.2020.102447.

Superfici chiave

Active Inference e Robotica in sintesi

Ciclo di inferenza unificato

L'inferenza attiva rielabora la stima dello stato, il controllo e l'apprendimento come una singola minimizzazione dell'energia libera variazioneale sotto un modello generativo unitario, piuttosto che moduli separati e patchati manualmente.

Tolleranza agli errori ponderata con precisione

L'apprendimento della precisione residua beta consente ai controllori dei manipolatori di ridurre al minimo i canali di sensore non affidabili in tempo reale, mantenendo le prestazioni in caso di guasti dei sensori.

Evidenza di qualità mista

I risultati coprono lavori pubblicati su riviste sottoposte a revisione paritaria (IEEE RAL, tutoriali indicizzati in PubMed) e preprint o articoli di blog aziendali non sottoposti a revisione (Verses AI), senza che esista ancora una suite di benchmark standardizzata per confrontare l'inferenza attiva con il controllo classico o il RL.

Risorse correlate

Link pubblici per questa pagina

I collegamenti esterni vengono risolti dal registro condiviso, quindi le destinazioni visibili ai visitatori rimangono centralizzate e verificabili.

Repository / Projects

GitHub organization

Audience: Developer

Public GitHub organization for Institute repositories and open-source work.

projectsgithub-org