摘要
多智能体系统通常旨在通过投票或共识协议减少分歧。本文指出,在涉及价值判断的任务中,分歧可能反映规范性不确定性而非错误。我们提出一种知识表示层,将推理轨迹和决策抽象为符号化分歧状态。基于推理相似性与结论一致性,定义了四种状态以支持可废止的战略路由规则。该框架在内容审核中实例化,桥接了子符号 LLM deliberation 与多智能体战略推理的符号知识表示。
AI 推荐理由
论文核心研究推理轨迹差异作为知识表示信号,深入探讨多智能体推理机制。
研究机构
Laboratory of The New Ethos, Warsaw University of Technology, Warsaw, Poland
Institute of Computer Science, Faculty of Electronics and Information Technology, Warsaw University of Technology, Warsaw, Poland
论文信息