automated reasoning formal mathematics benchmark
摘要

随着自动推理系统的快速发展,亟需研究级的形式化数学问题以准确评估其能力。本文提出

AI 推荐理由

论文核心是构建数学推理基准,直接评估自动化系统在研究级数学证明发现中的推理能力。

研究机构
Google DeepMind Imperial College London Stockholms universitet Google
论文信息
作者 Moritz Firsching, Paul Lezeau, Salvatore Mercuri, Miklós Z. Horváth, Yaël Dillies et al.
发布日期 2026-05-13
arXiv ID 2605.13171
相关性评分 9/10 (高度相关)