摘要
针对自主 AI 智能体在关键环境中的治理缺口,本文提出一种神经认知治理框架。该框架借鉴人类自我治理机制,将治理原则内化为智能体的行为准则,而非外部约束。通过构建“预行动治理推理循环(PAGRL)”,智能体在执行关键动作前,依据四层规则集进行 deliberation(深思熟虑)的推理评估。实验表明,该方法显著提升了合规性与可解释性,实现了类人的自我治理。
AI 推荐理由
提出预行动治理推理循环,将治理内化为 Agent 的核心推理机制。
研究机构
Old Dominion University, Norfolk, VA, USA
论文信息