推荐 5.5
Conf: 50%
该论文研究了基于大语言模型(LLM)的多智能体系统中的故障定位问题。在多智能体系统中,多个LLM驱动的智能体通过协调推理和行动来解决复杂任务,但由于长期交互和智能体行为的紧密耦合,当执行失败时,很难确定哪个智能体负责以及轨迹在哪个点首次变得不可逆转地偏离正确方向。为此,论文提出了AgentLocate框架,该框架将故障归因于特定的智能体和最早的关键决策步骤。AgentLocate结合了基于LLM的判断机制和独立评估者的多视角验证,通过置信度感知策略聚合评估结果。此外,利用反馈通过轻量级微调自适应地改进判断器,从而提高归因质量。论文在两个互补的基准上评估了AgentLocate,这些基准涵盖了多样化的任务、智能体配置和轨迹长度。实验结果表明,AgentLocate在识别责任智能体和故障步骤方面始终优于现有的故障定位方法,同时在令牌使用和运行时间方面保持高效。该工作对于提高LLM多智能体系统的可调试性和可靠性具有重要意义,尤其适用于需要严格故障分析的场景,如自主代理、机器人协作和复杂决策系统。
💡 推荐理由: 多智能体系统故障定位是保障系统可靠性的关键,现有方法难以处理智能体间复杂依赖。AgentLocate提供了一种高效、准确的归因方案,可直接应用于LLM驱动的自动化系统调试。
🎯 建议动作: 研究跟进
排序因子: 来自 arXiv 其他板块 (+2) | 命中热门研究主题 (+2) | Community 数据源 (+1) | LLM 评分加成 (+0.5)