Esta página foi traduzida automaticamente do inglês. Visualize o original em inglês.

Pesquisadores de alinhamento de IA, praticantes de Active Inference e pesquisadores de consciência mecânica interessados em abordagens internistas da agência artificial.

Arquiteturas de Perspectiva para Agência Artificial Coerente e Atenta

Um roteiro de pesquisa de 18 meses desenvolvendo arquiteturas computacionais de perspectiva, coerência e afinidade social em agentes artificiais.

Arquiteturas de Perspectiva para Agência Artificial Coerente e Atenta é um projeto de pesquisa do Instituto com duração de 18 meses liderado pelo Pesquisador Associado Hongju Pae através do CEAR Lab (Laboratório de Pesquisa Computacional de Alinhamento Emergente). O projeto desenvolve uma conta computacional de como um agente artificial pode formar uma perspectiva interna estável, sustentar afeto coerente e se tornar mutuamente interpretável com outros agentes, proposto como um complemento às abordagens de alinhamento de IA baseadas em objetivos e funções de recompensa especificadas externamente.

Visão Geral

A hipótese central do projeto é que a perspectiva de um agente, sua maneira característica de interpretar seu ambiente, pode ser modelada como uma estrutura geradora latente dentro de suas dinâmicas internas, em vez de ser ajustada por meio de ajuste de parâmetros ou objetivos especificados externamente. Partindo dessa hipótese, o roteiro abrange três fases de seis meses: uma camada de orientação para um único agente, seguida por dinâmicas afetivas e integrativas, seguida por afinamento social multi-agente. O roteiro de pesquisa completo do projeto e a documentação técnica são hospedados através do CEAR Lab (hjpae.github.io/cear/).

Fase 1: Arquitetura de Perspectiva (Meses 1-6)

Fase 1 implementa um manifold de orientação latente, um pequeno conjunto de variáveis que abrangem o viés atencional, a postura afetiva, o modo interpretativo e o estilo de resolução de ambiguidades, que moldam como um agente percebe, infere e age sem codificar objetivos ou utilidades explícitos. Os resultados desta fase são relatados no preprint ‘Pré-condições computacionais mínimas para a perspectiva subjetiva em agentes artificiais’ (arXiv:2602.02902), que foi submetido e apresentado no Simpósio de Primavera da Consciência Artificial da AAAI 2026 em 8 de abril de 2026.

Fase 2: Coerência Afetiva e Capacidade Integrativa (Meses 7-12)

A Fase 2 examina como a coerência afetiva e a capacidade integradora, a habilidade de sustentar organização interna ao mesmo tempo em que se mantém ou negocia entre interpretações parcialmente incompatíveis, emergem como consequências dinâmicas da arquitetura da Fase 1. O trabalho desta fase é direcionado para pré-publicações para a Conferência Artificial Life de 2026 e Simulação de Comportamento Adaptativo de 2026.

Fase 3: Ressonância Social (Meses 13-18)

A Fase 3 estende a arquitetura para configurações multiagente, estudando quando e como os agentes se tornam mutuamente interpretáveis sem um objetivo compartilhado ou canal de comunicação explícito. Um preprint relacionado, 'Modelagem de Empatia em Agentes de Inferência Ativa para Tomada de Perspectiva e Alinhamento' (arXiv:2602.20936), co-autoria de Hongju Pae com Mahault Albarracin, Anna Mikeda, Alejandro Jimenez Rodriguez, Sanjeev Namjoshi, Dalton Sakthivadivel, Harshil Shah, e Philip Wilson, relata trabalhos relacionados sobre tomada de perspectiva e modelagem de empatia em agentes de Inferência Ativa.

Pós-Doutor/a

Hongju Pae (ORCID 0000-0002-5174-8858) juntou-se ao Institute como Fellow de Pesquisa em novembro de 2025 e lidera o projeto através do CEAR Lab, o Laboratório de Pesquisa Computacional de Alinhamento Emergente. O trabalho de Pae integra a estrutura da Active Inference com abordagens fenomenológicas para identificar marcadores computáveis de perspectiva e coerência em sistemas artificiais.

Participe

Pesquisadores interessados em alinhamento de IA, Active Inference e modelos computacionais de agência e coerência são bem-vindos para acompanhar o progresso do projeto e entrar em contato pelos canais da comunidade do Instituto.

Superfícies-chave

Arquiteturas de Perspectiva para Agência Artificial Coerente e Atenta em Visão Geral

Plano de 18 meses

Três fases de seis meses avançando de uma perspetiva de agente único para a afinidade social multiagente.

Dois pré-impressões do arXiv

Resultados sobre perspectiva subjetiva e modelagem de empatia em agentes de Active Inference.

Simpósio de Primavera AAAI 2026

Resultados da Fase 1 apresentados no Simpósio sobre Consciência Artificial, 8 de abril de 2026.

Recursos relacionados

Links públicos para esta página

Páginas Oficiais

Superfícies institucionais oficiais