Esta página foi traduzida automaticamente do inglês. Visualize o original em inglês.

Pesquisadores de alinhamento de IA, praticantes de Active Inference e pesquisadores de consciência mecânica interessados em abordagens internistas da agência artificial.

Arquiteturas de Perspectiva para Agência Artificial Coerente e Atenta

Um roteiro de pesquisa de 18 meses desenvolvendo arquiteturas computacionais de perspectiva, coerência e afinidade social em agentes artificiais.

Arquiteturas de Perspectiva para Agência Artificial Coerente e Atenta é um projeto de pesquisa do Instituto com duração de 18 meses liderado pelo Pesquisador Associado Hongju Pae através do CEAR Lab (Laboratório de Pesquisa Computacional de Alinhamento Emergente). O projeto desenvolve uma conta computacional de como um agente artificial pode formar uma perspectiva interna estável, sustentar afeto coerente e se tornar mutuamente interpretável com outros agentes, proposto como um complemento às abordagens de alinhamento de IA baseadas em objetivos e funções de recompensa especificadas externamente.

Visão Geral

The project's central hypothesis is that an agent's perspective, its characteristic way of interpreting its environment, can be modeled as a latent generative structure within its internal dynamics, rather than adjusted through parameter tuning or externally specified objectives. Working from this hypothesis, the roadmap runs across three six-month phases: a single-agent orientation layer, followed by affective and integrative dynamics, followed by multi-agent social attunement.

The project's full research roadmap and technical documentation are hosted through CEAR Lab (hjpae.github.io/cear/).

Fase 1: Arquitetura de Perspectiva (Meses 1-6)

Fase 1 implementa um manifold de orientação latente, um pequeno conjunto de variáveis que abrangem o viés atencional, a postura afetiva, o modo interpretativo e o estilo de resolução de ambiguidades, que moldam como um agente percebe, infere e age sem codificar objetivos ou utilidades explícitos. Os resultados desta fase são relatados no preprint ‘Pré-condições computacionais mínimas para a perspectiva subjetiva em agentes artificiais’ (arXiv:2602.02902), que foi submetido e apresentado no Simpósio de Primavera da Consciência Artificial da AAAI 2026 em 8 de abril de 2026.

Fase 2: Coerência Afetiva e Capacidade Integrativa (Meses 7-12)

A Fase 2 examina como a coerência afetiva e a capacidade integradora, a habilidade de sustentar organização interna ao mesmo tempo em que se mantém ou negocia entre interpretações parcialmente incompatíveis, emergem como consequências dinâmicas da arquitetura da Fase 1. O trabalho desta fase é direcionado para pré-publicações para a Conferência Artificial Life de 2026 e Simulação de Comportamento Adaptativo de 2026.

Fase 3: Ressonância Social (Meses 13-18)

A Fase 3 estende a arquitetura para configurações multiagente, estudando quando e como os agentes se tornam mutuamente interpretáveis sem um objetivo compartilhado ou canal de comunicação explícito. Um preprint relacionado, 'Modelagem de Empatia em Agentes de Inferência Ativa para Tomada de Perspectiva e Alinhamento' (arXiv:2602.20936), co-autoria de Hongju Pae com Mahault Albarracin, Anna Mikeda, Alejandro Jimenez Rodriguez, Sanjeev Namjoshi, Dalton Sakthivadivel, Harshil Shah, e Philip Wilson, relata trabalhos relacionados sobre tomada de perspectiva e modelagem de empatia em agentes de Inferência Ativa.

Pós-Doutor/a

Hongju Pae (ORCID 0000-0002-5174-8858) juntou-se ao Institute como Fellow de Pesquisa em novembro de 2025 e lidera o projeto através do CEAR Lab, o Laboratório de Pesquisa Computacional de Alinhamento Emergente. O trabalho de Pae integra a estrutura da Active Inference com abordagens fenomenológicas para identificar marcadores computáveis de perspectiva e coerência em sistemas artificiais.

Participe

Pesquisadores interessados em alinhamento de IA, Active Inference e modelos computacionais de agência e coerência são bem-vindos para acompanhar o progresso do projeto e entrar em contato pelos canais da comunidade do Instituto.

Superfícies-chave

Arquiteturas de Perspectiva para Agência Artificial Coerente e Atenta em Visão Geral

Plano de 18 meses

Três fases de seis meses avançando de uma perspetiva de agente único para a afinidade social multiagente.

Dois pré-impressões do arXiv

Resultados sobre perspectiva subjetiva e modelagem de empatia em agentes de Active Inference.

Simpósio de Primavera AAAI 2026

Resultados da Fase 1 apresentados no Simpósio sobre Consciência Artificial, 8 de abril de 2026.

Recursos relacionados

Links públicos para esta página

Páginas Oficiais

Superfícies institucionais oficiais