Multi-Agent System Engineering Design Benchmark Task Orchestration
摘要

针对现有评估框架在结合仿真、检索与制造准备的多智能体系统方面的不足,本文提出 EngiAI 基准套件及多智能体系统参考实现。该基准涵盖工作流、检索增强生成及高性能计算编排三个维度,评估直接工具使用、语义消歧、条件分支等认知需求。基于 LangGraph 构建的系统协调七个专用智能体,统一拓扑优化、文档检索及 3D 打印控制。实验表明,专有模型在任务完成率上表现优异,但条件分支与长程工作流中的多步指令遵循仍是主要挑战。

AI 推荐理由

论文核心在于多智能体协作框架,涉及复杂工作流编排、条件分支及多步任务执行,属典型规划研究。

研究机构
IDEAL, Chair of Artificial Intelligence in Engineering Design, ETH Zurich, Zürich, Switzerland IDEAL, ETH Zürich, Zürich, Switzerland Autom8.build, Brussels, Belgium
论文信息
作者 Gioele Molinari, Florian Felten, Soheyl Massoudi, Mark Fuge
发布日期 2026-05-19
arXiv ID 2605.19743
相关性评分 9/10 (高度相关)