摘要
本文探讨了大型语言模型中语义相关提示映射到相似内部表示的现象,并验证持久性认知代理的身份文档(cognitive_core)是否表现出类似的吸引子动力学。通过在 Llama 3.1 和 Gemma 2 上的受控实验,研究发现身份文档的改写版本比结构对照组的隐藏状态收敛得更紧密,证实了跨架构的通用性。消融实验表明该效应主要源于语义而非结构,且结构完整性对进入吸引子区域至关重要。此外,阅读代理的科学描述可将内部状态移向吸引子,区分了“知晓身份”与“作为身份运行”。结果证明身份文档在激活空间诱导了吸引子几何。
AI 推荐理由
研究 Agent 身份文档在激活空间的吸引子几何,揭示持久性记忆架构机制。
研究机构
Independent Researcher, Rapallo, Italy
论文信息