moral reasoning alignment training logical coherence empirical analysis
摘要

本文探究大语言模型在道德困境中是否具备真正的道德推理能力,亦或仅通过对齐训练习得了成熟的道德修辞表象。研究基于科尔伯格道德发展阶段论,利用

AI 推荐理由

论文核心评估 LLM 道德推理的真实性、一致性及逻辑连贯性,直接针对推理能力。

研究机构
TCS AI Practice UT Austin Amazon GenAI Google GenAI
论文信息
作者 Aryan Kasat, Smriti Singh, Aman Chadha, Vinija Jain
发布日期 2026-03-23
arXiv ID 2603.21854
相关性评分 9/10 (高度相关)