Tool Use Model Distillation Behavioral Homogenization Agent Evaluation
摘要

模型蒸馏推动了 LLM 智能体的快速发展,但也导致行为同质化。现有指标难以区分任务必需的强制行为与反映模型自主偏好的非强制模式。本文提出两种互补指标:用于语言对齐的响应模式相似性(RPS)和用于建模工具使用习惯的动作图相似性(AGS)。通过对 8 家提供商的 18 个模型进行评估,发现同家族模型对的 AGS 得分显著高于跨家族对,且特定模型表现出极高的节点与依赖相似度。控制实验证实 AGS 能有效区分教师特定的收敛与通用改进,为智能体生态的行为收敛提供了独特的诊断信号。

AI 推荐理由

论文核心研究智能体工具使用行为的同质化,提出量化指标评估技能学习中的蒸馏效应。

研究机构
School of Cyber Science and Technology, USTC Anhui Province Key Laboratory of Digital Security M-A-P, NJU
论文信息
作者 Chenghao Yang, Yuning Zhang, Zhoufutu Wen, Tao Gong, Jiaheng Liu et al.
发布日期 2026-04-23
arXiv ID 2604.21255
相关性评分 9/10 (高度相关)