推荐 10.5
Conf: 50%
本文针对检索增强生成(RAG)系统中证据冲突这一根本性挑战,提出了一种新的研究问题——冲突来源归因(conflict origin attribution),并设计了无训练框架 EvoTrustRAG。在动态和对抗性环境中,同一冲突可能源自合法的知识演化、恶意操纵或尚未解决的不确定性,而现有方法通常将冲突视为静态不一致,仅选择更可靠的知识,忽略了冲突的演化属性。EvoTrustRAG 在答案生成之前,将基于跨度(span)的检索事实建模为冲突证据图,利用时间关系、支持结构和辅助一致性评估 grounded evolution(基于证据的演化)与方向性干预假设,并将局部决策投影为全局一致的冲突组解释。该归因过程决定早期与后期状态是保留为时间知识、将干预候选与主要上下文分离,还是作为未解决冲突保持可见供生成器参考。与基于溯源(provenance)的事后分析方法不同,EvoTrustRAG 在推理阶段即可判断冲突证据是否遵循合理的知识演化、是否呈现类似干预的支持结构,或无法可靠归因。实验表明,EvoTrustRAG 在基准原生冲突设置上平均准确率达 81.4%,将归因宏 F1 比最强基线提升 7 个百分点(72.2% → 79.1%),并在最强协同攻击下将错误率从 31.2% 降至 16.0%。该工作为 RAG 的鲁棒性提供了一种不依赖微调、可在推理时动态处理冲突的通用方法,适合关注大模型安全、对抗鲁棒性与信息可信度的研究人员和工程团队阅读。
💡 推荐理由: 该文首次将冲突归因作为独立问题引入 RAG,使系统不只选答案,还能识别冲突是演化、干预还是未决,对对抗性检索场景的防御设计有直接启发。
🎯 建议动作: 研究跟进
排序因子: 影响边界/网络设备 (+5) | 来自 arXiv 其他板块 (+2) | 命中热门研究主题 (+2) | Community 数据源 (+1) | LLM 评分加成 (+0.5)