सुसंगत और अनुकूलित कृत्रिम एजेंसी के लिए परिप्रेक्ष्य आर्किटेक्चर एक 18 महीने का संस्थान अनुसंधान प्रोजेक्ट है जिसका नेतृत्व Research Fellow होंगजू पेई CEAR लैब (कम्प्यूटेशनल इमर्जेंट अलाइनमेंट रिसर्च लैब) के माध्यम से कर रहे हैं। यह प्रोजेक्ट एक कम्प्यूटेशनल विवरण विकसित करता है कि कैसे एक कृत्रिम एजेंट एक स्थिर आंतरिक परिप्रेक्ष्य बना सकता है, सुसंगत प्रभाव बनाए रख सकता है, और अन्य एजेंटों के साथ पारस्परिक रूप से व्याख्या योग्य बन सकता है, जिसे बाहरी रूप से निर्दिष्ट उद्देश्यों और इनाम कार्यों पर निर्मित AI संरेखण दृष्टिकोणों के पूरक के रूप में प्रस्तावित किया गया है।
ओवरव्यू
परियोजना का केंद्रीय परिकल्पना यह है कि एक एजेंट का दृष्टिकोण, उसके पर्यावरण की विशेषता के अनुसार व्याख्या करने का तरीका, उसके आंतरिक गतिशीलता के भीतर एक छिपे हुए जनरेटिव संरचना के रूप में मॉडल किया जा सकता है, इसके बजाय पैरामीटर ट्यूनिंग या बाहरी निर्दिष्ट उद्देश्यों के माध्यम से समायोजित किया जा सकता है। इस परिकल्पना से काम करते हुए, रोडमैप तीन छह-महीने के चरणों में फैला हुआ है: एक एकल-एजेंट ओरिएंटेशन परत, इसके बाद भावनात्मक और एकीकृत गतिशीलता, और अंत में बहु-एजेंट सामाजिक तालमेल।
चरण 1: दृष्टिकोण वास्तुकला (महीने 1-6)
पहला चरण एक अंतर्निहित अभिविन्यास मैनोफोल्ड को लागू करता है, जिसमें ध्यान पूर्वाग्रह, भावनात्मक रुख, व्याख्यात्मक मोड और अस्पष्टता समाधान शैली जैसे कुछ चर होते हैं जो एक एजेंट की धारणा, अनुमान और कार्रवाई को आकार देते हैं बिना स्पष्ट लक्ष्यों या उपयोगिताओं को एन्कोड किए। इस चरण के निष्कर्षों को 'कृत्रिम एजेंटों में व्यक्तिपरक परिप्रेक्ष्य के लिए न्यूनतम कम्प्यूटेशनल पूर्वशर्तें' नामक प्रीप्रिंट में रिपोर्ट किया गया है (arXiv:2602.02902), जिसे AAAI 2026 स्प्रिंग सिम्posium ऑन मशीन कंशियसनेस में अप्रैल 8, 2026 को जमा किया गया था और प्रस्तुत किया गया था।
चरण 2: भावनात्मक सामंजस्य और एकीकृत क्षमता (महीने 7-12)
चरण 2 भावनात्मक सामंजस्य और एकीकृत क्षमता, आंतरिक संगठन बनाए रखने और आंशिक रूप से असंगत व्याख्याओं के बीच सामंजस्य स्थापित करने की क्षमता के विकास का अध्ययन करता है जो चरण 1 वास्तुकला के गतिशील परिणामों के रूप में उत्पन्न होते हैं। इस चरण के कार्य 2026 आर्टिफिशियल लाइफ सम्मेलन और सिमुलेशन ऑफ एडेप्टिव बिहेवियर 2026 के लिए प्रीप्रिंट्स की ओर निर्देशित हैं।
चरण 3: सामाजिक प्रतिध्वनि (महीने 13-18)
चरण 3 बहु-एजेंट सेटिंग्स में आर्किटेक्चर का विस्तार करता है, यह अध्ययन करता है कि एजेंट बिना साझा उद्देश्य या स्पष्ट संचार चैनल के एक दूसरे को समझने कब और कैसे बनाते हैं। संबंधित प्रीप्रिंट, 'समानुभूति मॉडलिंग सक्रिय अनुमान एजेंटों में दृष्टिकोण लेने और संरेखण के लिए' (arXiv:2602.20936), जो होंगजू पाए, माहुलट अल्बार्रासिन, अन्ना मिकेदा, एलेजांद्रो जिमेनेज़ रोड्रिगेज, सानजीव नामजोशी, डल्टन सक्तिवादेवल, हारशील शाह और फिलिप विल्सन द्वारा सह-लेखन किया गया है, सक्रिय अनुमान एजेंटों में दृष्टिकोण लेने और सहानुभूति मॉडलिंग पर संबंधित कार्य की रिपोर्ट करता है।
अनुसंधान विद्वान
होंगजू पेई (ORCID 0000-0002-5174-8858) नवंबर 2025 में एक Research Fellow के रूप में संस्थान में शामिल हुए और CEAR लैब, कम्प्यूटेशनल इमर्जेंट अलाइनमेंट रिसर्च लैब के माध्यम से परियोजना का नेतृत्व करते हैं। पेई का काम कृत्रिम प्रणालियों में परिप्रेक्ष्य और सुसंगतता के गणना योग्य मार्करों की पहचान करने के लिए घटनात्मक दृष्टिकोणों के साथ Active Inference ढांचे को एकीकृत करता है।
भाग लें
कृत्रिम बुद्धिमत्ता संरेखण, सक्रिय अनुमान और एजेंसी और सुसंगतता के कम्प्यूटेशनल मॉडल में रुचि रखने वाले शोधकर्ताओं को परियोजना की प्रगति का अनुसरण करने और संस्थान के समुदाय चैनलों के माध्यम से संपर्क करने के लिए स्वागत है।