이 페이지는 기계 번역된 영어 페이지입니다. 영어 원본 보기

AI 정렬 연구자, Active Inference 실무자, 인공 에이전시의 내재적 접근 방식에 관심 있는 기계 의식 연구자

조화와 공감을 갖춘 인공agency의 통일적인 설계 기법

인공_agents의perspective, coherence, 그리고social attunement을developing computational architectures하는18개월 연구계획

일관되고 조화로운 인공 에이전시를 위한 관점 아키텍처는 CEAR Lab(Computational Emergent Alignment Research Lab)의 Research Fellow 홍주 패가 주도하는 18개월간의 연구 프로젝트입니다. 이 프로젝트는 인공 에이전트가 안정적인 내부 관점을 형성하고, 일관된 감정을 유지하며, 다른 에이전트와 상호 해석 가능하게 되는 방법에 대한 계산적 설명을 개발하며, 외부에서 지정된 목표 및 보상 함수를 기반으로 구축된 AI 정렬 접근 방식에 대한 보완책으로 제안됩니다.

개요

프로젝트의 중앙 가설은 동물의 환경을 해석하는 특이한 방식이 동물 내부 동적인 내재적인 구조로 모델링될 수 있으며, 파라미터 페인팅 또는 외부 지정된 목표를 통해 조정되는 대신입니다. 이 가설을 기반으로 프로젝트의 전체 연구 레이아웃과 기술 문서는 CEAR Lab (hjpae.github.io/cear/)에서 공유됩니다.

기본 시각화 구조 (월 1-6)

파일 1은 잠재적 방향 manifold을 구현합니다. 이것은 주의력 균형, 감정 기조, 해석 모드 및 불확실성 해결 스타일이라는 주의를 집중시키는 변수들의 작은 집합으로, 이들이 인공_agent가 무의식적으로 인지, 추론하고 행동하는 방향을 결정합니다. 이러한 연구의 결과는 '미니멀한 계산적 조건에서 인공_agents의 주관적인 시각에 대한 주제'라는 제목의 논문에서 보고되었습니다. 이 논문은 AAAI 2026 봄 심포지엄: 머신-consciousness에 제출되었으며, 4월 8일에 발표되었습니다. (arXiv:2602.02902)

파지 2: 감정적 일치와 통합 능력 (월 7-12)

Phase 2는 어떻게 상호 배타적인 해석을 유지하거나 조정하면서 내부 조직을 지속적으로 유지하는 감정적 일관성과 통합 능력이, Phase 1 아키텍처의 동역학적 결과로 발생하는지에 대해 연구합니다. 이 단계에서 수행된 작업은 2026 Artificial Life Conference 및 Simulation of Adaptive Behavior 2026에서 제출할 예정인 논문을 목표로 합니다.

사회적 동의 (월 13-18)

3차 시 Phase는 다중-agents 환경에 대한 아키텍처를 확장하고 있으며, agents가 서로 해석 가능해지는 순간과 방법을 연구합니다. 이와 관련된 미리 게시물 'Active Inference Agent의 Perspective-Taking 및 조화로움 모델링 (arXiv:2602.20936)'은 홍주 파와 마하울트 알바라친, 안나 미케다, 아레가일레 잉제르돈, 산제브 남지오시, 다틀론 사크티발, 하르실

연구원

홍주 배(ORCID 0000-0002-5174-8858)는 2025년 11월에 Research Fellow로 연구소에 합류했으며, CEAR Lab(Computational Emergent Alignment Research Lab)을 통해 프로젝트를 이끌고 있습니다. 배의 연구는 Active Inference 프레임워크를 현상학적 접근 방식과 통합하여 인공 시스템에서 관점과 일관성의 계산 가능한 마커를 식별합니다.

참여하기

AI 정렬, Active Inference, 그리고 에이전시 및 일관성의 계산 모델에 관심 있는 연구자들은 프로젝트 진행 상황을 팔로우하고 연구소 커뮤니티 채널을 통해 연락할 수 있습니다.

주요 표면

조화롭고 조화로운 인공agency에 대한 통합된 설계 모드 보기

18개월 Roadmap

삼육개월 단계가 있는 세 가지 프로세스로, 단일-agente의 시각에서 여러-agente의 사회적 감성화까지 이동합니다.

두 개의 arXiv 미리 보기 논문

Active Inference 에이전트의 주관적 관점 및 공감 모델링에 대한 연구 결과

AAAI 2026春シンポジウム

4월 8일 2026년 머신-consciousness 세미나에서 발표된 Phase 1 결과

관련 자료

이 페이지의 공개 링크

공식 페이지

공식 연구소 표면