形式推理 多语言基准 逻辑解析 内容效应
摘要

大语言模型在推理任务中常受内容效应影响,尤其在多语言场景下表现显著。本文提出一种新方法,通过显式的结构抽象将三段论转化为规范逻辑表示,并应用确定性解析来判断其有效性。在 SemEval-2026 任务 11 多语言基准测试中,该方法在所有子任务中均进入前五名,大幅降低了内容效应,为复杂的微调或激活层干预提供了具有竞争力的替代方案。

AI 推荐理由

论文核心在于通过结构抽象和确定性解析提升 LLM 的形式推理能力,解决内容偏差问题。

研究机构
Universitas Indonesia Mantera Studio Cohere
论文信息
作者 Wicaksono Leksono Muhamad, Joanito Agili Lopo, Tack Hwa Wong, Muhammad Ravi Shulthan Habibi, Samuel Cahyawijaya
发布日期 2026-03-03
arXiv ID 2603.02676
相关性评分 9/10 (高度相关)