推荐 10.5
Conf: 50%
恶意Python包已成为开源软件供应链生态系统(如PyPI)的主要安全威胁。现有基于学习的检测方法难以捕获不同程序实体之间的层次组织结构和异构交互。大型语言模型(LLM)在代码理解和语义推理方面表现出强大能力,但很少与结构化程序表示相结合用于细粒度恶意行为分析。本文提出了一种LLM增强的层次异构图表示学习框架,用于恶意Python包检测。该框架构建了一个层次异构代码图,显式建模异构代码实体和不同类型的结构依赖关系。进一步利用LLM推断函数级语义角色,引入额外的语义异构层。基于该图,开发了一种层次异构图神经网络,在不同节点和边类别上执行类型感知的消息传递,有效建模恶意行为传播以实现准确的包级分类。框架还融合了函数级归因机制,结合LLM推理,自动识别可疑函数并定位细粒度恶意行为,无需人工专家干预。在真实数据集上的大量实验表明,该框架在不同大小和依赖复杂性的包上,始终优于传统机器学习方法、基于图的检测器以及最先进的LLM,同时提供了准确、鲁棒且可解释的恶意行为定位。
💡 推荐理由: 本工作将LLM与层次异构图学习结合,为检测恶意Python包提供了新思路,有望提升软件供应链安全防御的自动化与精准度。
🎯 建议动作: 纳入内部研究评估
排序因子: 影响边界/网络设备 (+5) | 来自 arXiv 其他板块 (+2) | 命中热门研究主题 (+2) | Community 数据源 (+1) | LLM 评分加成 (+0.5)