このページは機械翻訳によって英語から日本語に翻訳されました。 英語のオリジナルをご覧ください。

人工代理者の内部主義的なアプローチに興味を持つAIalignment研究者、ActiveInferenceの専門家、そして機械的意識の研究者

コherentかつattuned人工代理人的ための構造的なアーキテクチャ

人工代理者の視点、連携性、社会的調和に関する計算構造を18カ月間研究するためのマッピング

コherent{count}とattuned人工agencyのためのPerspectiveアーキテクチャは、CEAR Lab (Computational Emergent Alignment Research Lab) がResearch Fellow Hongju Paeによってリードされる18ヶ月間のインスティ tutuute リサーチプロジェクトです。このプロジェクトでは、人工代理人が安定した内部視点を形成し、コherentな感情を維持し、他の代理人と互いに解釈可能になるための計算上の説明を開発します。これは、外部で指定された目標や報酬関数に基づくAIアライメントアプローチの補完として提案されています。

概要

プロジェクトの中心的な仮説は、その代理人が環境を解釈する特有な方法を内部動態内の潜在的な生成構造としてモデル化できることです。これはパラメータの調整や外部で指定された目的を通じて修正されないことです。この仮説に基づき、プロジェクトの研究全体の道筋は3つの6ヶ月間のフェーズに分かれています:単独代理人の方向性層から感情と統合的なダイナミクス、そして多代理人的社会的調和まで続きます。プロジェクトの完全な研究道筋と技術ドキュメンテーションはCEAR Lab(hjpae.github.io/cear/)を通じてホストされています。

第1フェーズ:視点アーキテクチャ(月1-6)

第1フェーズでは、注意偏向、感情的立場、解釈モード、不確実性解決スタイルを含む注意力バイアス、感情的立ち位置、解釈モード、不確実性解決スタイルをカバーする小さな変数セットである潜在的な方向マナフローマンテナントを使用し、エージェントが意識的に目標や有用性を記述しない限りは、認識、推論、行動に影響を与えます。このフェーズの結果は、人工代理人的類的視点を持つ人工代理者に対する最小限のコンピューターショー予備研究『Minimal Computational Preconditions for Subjective Perspective in Artificial Agents』(arXiv:2602.02902)で報告され、4月8日にAAAI 2026春シンポジウムにおける機械的意識のプレゼンテーションと提出されました。

第2フェーズ:感情的一致性と統合的な能力(月7-12)

第二フェーズでは、Phase 1の構造が引き起こす感情的統一性と整合的な能力、つまり内部組織を維持しつつ部分的に不一致な解釈間で交渉または調整する能力がどのように生まれるかを examinesします。このフェーズのワークは、2026年の人工生命大会と適応行動シミュレーション2026への論文プレプリントに向けられています。

第3フェーズ:社会的 resonance(月13-18)

Phase 3は多_agent環境にアーキテクチャを拡張し、agentsが互いに解釈可能になる場合とその方法について研究します。これは共有の目的や明示的な通信チャネルがない条件下です。関連するプレプリント『Active Inference Agentsによる視点取扱いとアライメントに対する共感モデル化』(arXiv:2602.20936)をHongju PaeがMahault Albarracin、Anna Mikeda、Alejandro Jimenez Rodriguez、Sanjeev Namjoshi、Dalton Sakthivadivel、Harshil Shah、Philip Wilsonと共同執筆し、Active Inference Agentsにおける視点取扱いと共感モデル化に関する関連する研究を報告しています。

研究員

ホンジュ・パエ (ORCID 0000-0002-5174-8858)は2025年11月に institute で研究フェローとして参加し、CEAR ラボ、計算的現象学的対話研究ラボのリーダーとしてプロジェクトを進行します。パエの工作は、人工システムにおける視点と整合性の可算標識を発見するため、アクティブインファーザーのフレームワークと現象学的なアプローチを統合しています。

参加する

AIアライメントに興味のある研究者、Active Inferenceと代理人および統一の計算モデルに関する興味がある者は、 institute のコミュニティチャネルを通じてプロジェクトの進捗を追跡し、連絡することができます。

キーの表面

コherentかつattuneされたartificialagencyに対する明快な構造

18カ月 Roadmap

三六月のフェーズが単一代理者視点から多代理者社会調節へと移行します。

二つのarXivプレプリント

Active Inference代理人における主観的視点と共感モデルの研究結果。

AAAI 2026 春季シンポジウム

シンボリック・コンsciousネスのシンポジウムで4月8日、2026年、第1フェーズの結果が発表されました。

関連リソース

このページの公開リンク

公式ページ

公式インスティテュート表面