Cette page a été traduite automatiquement de l'anglais. Consultez l'original en anglais.

Chercheurs sur l'alignement de l'IA, praticiens de l'inférence active, et chercheurs en conscience artificielle intéressés par les approches internes à l'agence artificielle.

Architectures de perspective pour une agence artificielle cohérente et accordée

Un calendrier de recherche sur 18 mois développant des architectures computationnelles de perspective, de cohérence et d'attunement social chez les agents artificiels.

Perspective Architectures for Coherent and Attuned Artificial Agency» est un projet de recherche de l'Institut d'une durée de 18 mois, dirigé par Research Fellow Hongju Pae via le CEAR Lab (Computational Emergent Alignment Research Lab). Le projet développe une approche computationnelle de la manière dont un agent artificiel pourrait former une perspective interne stable, maintenir un affect cohérent et devenir mutuellement interprétable avec d'autres agents, proposé comme un complément aux approches d'alignement de l'IA basées sur des objectifs et des fonctions de récompense spécifiés de l'extérieur.

Présentation générale

L'hypothèse centrale du projet est que la perspective d'un agent, sa manière caractéristique d'interpréter son environnement, peut être modélisée comme une structure génératrice latente au sein de ses dynamiques internes, plutôt que par un ajustement via un réglage de paramètres ou des objectifs spécifiés extérieurement. Sur la base de cette hypothèse, la feuille de route s'étend sur trois phases de six mois: une couche d'orientation d'un seul agent, suivie de la dynamique affective et intégrative, suivie de l'harmonie multi-agents sociale.

Phase 1 : Architecture de perspective (Mois 1 à 6)

Phase 1 met une variété de variables couvrant les biais d'attention, la posture affectif, le mode interprétatif et le style de résolution des ambiguïtés, qui façonnent la façon dont l'agent perçoit, infère et agit sans coder de buts ou d'utilités explicites. Les résultats de cette phase sont rapportés dans la prépublication «Minimal Computational Preconditions for Subjective Perspective in Artificial Agents» (arXiv:2602.02902), qui a été soumise et présentée au symposium printanier de l’AAI 2026 sur la conscience artificielle le 8 avril 2026.

Phase 2 : Cohérence affective et capacité intégrative (Mois 7-12)

La phase 2 examine comment la cohérence affectuelle et la capacité intégrative, l'aptitude à maintenir une organisation interne tout en conciliant ou en négociant entre des interprétations partiellement incompatibles, émergent comme des conséquences dynamiques de l'architecture de la phase 1. Le travail réalisé dans ce cadre est destiné aux prépublications pour la conférence Artificial Life 2026 et Simulation of Adaptive Behavior 2026.

Phase 3 : Résonance sociale (mois 13 à 18)

Phase 3 étend l'architecture aux environnements multi-agents, étudiant quand et comment les agents deviennent mutuellement interprétables sans objectif partagé ou canal de communication explicite. Une preprint connexe, «Modélisation de l'empathie dans des agents d'Active Inference pour la prise de perspective et l'alignement» (arXiv:2602.20936), co-écrit par Hongju Pae avec Mahault Albarracin, Anna Mikeda, Alejandro Jimenez Rodriguez, Sanjeev Namjoshi, Dalton Sakthivadivel, Harshil Shah et Philip Wilson, relate un travail connexe sur la prise de perspective et la modélisation de l'empathie dans des agents d'Active Inference.

Chercheur associé

Hongju Pae (ORCID 0000-0002-5174-8858) a rejoint l'Institut en tant que Research Fellow en novembre 2025 et dirige le projet via le CEAR Lab, le Computational Emergent Alignment Research Lab. Le travail de Pae intègre le cadre Active Inference avec des approches phénoménologiques pour identifier des marqueurs calculables de perspective et de cohérence dans les systèmes artificiels.

Participer

Les chercheurs intéressés par l'alignement de l'IA, l'Inférence Active et les modèles computationnels d'agence et de cohérence sont invités à suivre l'avancement du projet et à se renseigner via les canaux communautaires de l'Institut.

Surfaces clés

Architectures de perspective pour une agence artificielle cohérente et accordée en un coup d'œil

Roadmap des 18 mois

Trois phases de six mois évoluant d'une perspective d'agent unique à une adaptation sociale multi-agents.

Deux prépublications sur arXiv

Les résultats sur la perspective subjective et le modélisation de l'empathie dans les agents d’Active Inference.

Symposium Printemps AAAI 2026

Les conclusions de la phase 1 présentées au symposium sur la conscience artificielle, le 8 avril 2026.

Ressources associées

Liens publics pour cette page

Pages officielles

Surfaces institutionnelles officielles