AI Governance Agent Reasoning Safety Neurocognitive Model
摘要

针对自主 AI 智能体在关键环境中的治理缺口,本文提出一种神经认知治理框架。该框架借鉴人类自我治理机制,将治理原则内化为智能体的行为准则,而非外部约束。通过构建“预行动治理推理循环(PAGRL)”,智能体在执行关键动作前,依据四层规则集进行 deliberation(深思熟虑)的推理评估。实验表明,该方法显著提升了合规性与可解释性,实现了类人的自我治理。

AI 推荐理由

提出预行动治理推理循环,将治理内化为 Agent 的核心推理机制。

研究机构
Old Dominion University, Norfolk, VA, USA
论文信息
作者 Eranga Bandara, Ross Gore, Asanga Gunaratna, Sachini Rajapakse, Isurunima Kularathna et al.
发布日期 2026-04-28
arXiv ID 2604.25684
相关性评分 9/10 (高度相关)