摘要
本文探究大语言模型在道德困境中是否具备真正的道德推理能力,亦或仅通过对齐训练习得了成熟的道德修辞表象。研究基于科尔伯格道德发展阶段论,利用
AI 推荐理由
论文核心评估 LLM 道德推理的真实性、一致性及逻辑连贯性,直接针对推理能力。
研究机构
TCS AI Practice
UT Austin
Amazon GenAI
Google GenAI
论文信息