#automated-testing

共收录 5 条相关安全情报。

← 返回所有主题
👥 作者: Maosong Chen, Xi Chen, Mengcheng Ju, Dongliang Zhao, Chunxiang Gu

SeriCrypt 提出了一种由大语言模型驱动的、上下文感知的序列化框架,用于自动构造符合语法且密码学有效的协议消息序列。该问题对于协议状态机学习、一致性测试和模糊测试至关重要。与明文协议不同,密码协议存在跨消息的状态依赖和复杂的密码学计算约束,而现有自动化方法主要针对文本或明文协议,密码协议的消息构造仍主要依赖人工。SeriCrypt 的核心方法是利用大语言模型从非结构化的协议规范中提取字段约束、状态依赖和密码学计算规则,并将其转化为统一的、结构化的中间表示,这一表示由针对密码协议设计的领域特定语言 CDSL 正式刻画。随后,一个与协议无关的执行引擎解析 CDSL 声明,自动完成字段值求解、密码学原语调用和字节流序列化。在协议安全测试的应用场景中,作者使用该框架构造针对规范安全约束的违规消息,并支持协议模糊测试,在 TLS 1.2/1.3、IKEv1/v2、SSH 和 TLCP 的主流实现上进行了评估。实验结果表明,SeriCrypt 生成的消息序列被所有被测实现接受,且在所有场景中均能完成握手。安全约束测试发现了五个规范违规问题,模糊测试在相同时间预算下比主流模糊器达到更深的协议状态和更高的代码覆盖率。该工作展示了 LLM 驱动的自动化框架在密码协议安全测试中的实用价值,减少了人工构造协议消息的工作量,提升了协议实现测试的覆盖面。

💡 推荐理由: 密码协议测试长期依赖人工构造消息,SeriCrypt 首次将 LLM 与领域特定语言结合,自动化提取协议状态依赖和密码学约束,能直接提升 TLS/SSH 等核心协议的安全测试效率与深度,值得协议安全研究员和模糊测试工具开发者关注。

🎯 建议动作: 研究跟进

排序因子: 来自 arXiv 其他板块 (+2) | 命中热门研究主题 (+2) | Community 数据源 (+1) | LLM 评分加成 (+0.5)
推荐 16.6
Conf: 50%
👥 作者: Peng Chen 0034, Yuxuan Xie, Yunlong Lyu, Yuxiao Wang, Hao Chen 0003

该论文提出 HOPPER,一种无需领域知识即可对库进行模糊测试的解释性模糊测试工具。现有模糊测试工具通常需要手动构造模糊驱动(fuzz driver),其质量取决于开发者的代码理解,而自动生成驱动的方法又受限于已学习代码的调用序列。HOPPER 将库模糊测试问题转化为解释器模糊测试问题:被测库链接的解释器可解释描述任意 API 用法的输入。为了生成语义正确的输入,HOPPER 学习库内的接口内(intra-API)和接口间(inter-API)约束,并通过语法感知的变异生成测试用例。作者在 11 个真实库上评估 HOPPER,与手工编写的模糊器和自动化方案相比,HOPPER 在代码覆盖率和漏洞发现上均显著优于其他工具,发现了 25 个其他模糊器无法发现的未知 bug。实验表明,所提出的约束学习方法能正确学习库隐含的约束,大幅提升模糊测试效率。该工作为库级模糊测试提供了开箱即用的自动化方案,适合安全测试工具开发者和软件测试研究人员阅读。

💡 推荐理由: 库模糊测试是发现底层漏洞的重要途径,但传统方法依赖人工编写驱动,HOPPER 通过解释器思想结合约束学习,显著提升了自动化程度和漏洞发现能力,具有实际应用价值。

🎯 建议动作: 研究跟进

排序因子: 影响边界/网络设备 (+5) | 来自网络安全顶级会议 (+8) | 命中热门研究主题 (+2) | Community 数据源 (+1) | LLM 评分加成 (+0.6)
推荐 9.6
Conf: 50%
👥 作者: Gelei Deng, Zhiyi Zhang 0005, Yuekang Li, Yi Liu 0069, Tianwei Zhang 0004, Yang Liu 0003, Guo Yu, Dongjin Wang

本文提出 NAUTILUS,一种自动化检测 RESTful API 漏洞的系统。RESTful API 在现代微服务架构中广泛使用,但其安全测试面临状态依赖、参数组合爆炸等挑战。NAUTILUS 通过解析 API 规范(如 OpenAPI)构建状态机模型,并基于符号执行和模糊测试生成有效测试用例。系统覆盖常见漏洞类型,包括 SQL 注入、路径遍历、参数篡改等。在 GitHub 上的多个真实 API 以及人工构造的基准测试中,NAUTILUS 相比于现有工具(如 RESTler、EvoMaster)发现更多漏洞,且误报率更低。实验证明其能够有效处理复杂状态依赖和深层路径探索。该研究为自动化 API 安全测试提供了新的思路,适合安全工程师和开发者在 CI/CD 流程中集成。

💡 推荐理由: REST API 是现代应用的核心攻击面,手动测试效率低且容易遗漏。NAUTILUS 提供自动化方案,能显著提升漏洞发现效率,降低人工成本。

🎯 建议动作: 研究跟进

排序因子: 来自网络安全顶级会议 (+8) | Community 数据源 (+1) | LLM 评分加成 (+0.6)
👥 作者: Ze Sheng, Zhicheng Chen, Qingxiao Xu, Kewen Zhu, Jeff Huang

软件漏洞是严重的安全威胁,仅2025年报告的CVE数量就接近5万个。大型语言模型在自动化漏洞检测方面展现出潜力,但仍面临三大挑战:一是生成的漏洞报告误报率高且缺乏可重复验证;二是现有的LLM方法在漏洞定位时粒度选择次优,函数级分析在上下文过多时容易遗漏漏洞,而行级分析则缺乏足够的上下文;三是难以推理具有复杂跨函数依赖和触发条件的漏洞。针对这些问题,本文提出了FuzzingBrain V2,一个基于多智能体LLM的系统,其核心贡献包括:(1) 基于Google的OSS-Fuzz实现完全自动化的漏洞分析,确保所有报告的漏洞都可通过模糊测试复现;(2) 提出Suspicious Point这一基于控制流的新型抽象,实现最优粒度的精确漏洞定位;(3) 采用逻辑驱动的层次化函数分析与双层模糊测试,在资源约束下增强函数覆盖;(4) 基于MCP的静态和动态分析工具结合上下文工程,增强复杂漏洞的推理能力。在AIxCC 2025决赛的C/C++数据集上,FuzzingBrain V2实现了90%的检测率(40个漏洞中检测到36个)。在实际部署中,该工具在12个开源项目中发现了29个零日漏洞,所有漏洞均被维护者确认并修复,其中2个已分配CVE编号。

💡 推荐理由: 该研究提出了一种可复现、低误报的自动化漏洞发现系统,结合多智能体LLM与模糊测试,显著提升了真实世界漏洞检测效率,对蓝队和安全工程师评估LLM在漏洞挖掘中的实用性具有直接参考价值。

🎯 建议动作: 研究跟进

排序因子: 来自 arXiv 其他板块 (+2) | 命中热门研究主题 (+2) | Community 数据源 (+1) | LLM 评分加成 (+0.6)
👥 作者: Yi Chen 0024, Yepeng Yao, XiaoFeng Wang 0001, Dandan Xu, Chang Yue, Xiaozhong Liu 0001, Kai Chen 0012, Haixu Tang, Baoxu Liu

本文提出了一个名为Atomic的自动化框架,用于系统性地发现LTE蜂窝网络中的安全漏洞。研究背景是当前蜂窝网络漏洞发现主要依赖手动分析,效率低下且不全面。作者观察到LTE技术文档中包含大量“危险指示器”(HI),即描述在特定状态下发生某个事件时可能触发危险操作(如中止正在进行的过程)的语句。这些HI可以引导对系统的测试,以验证该操作是否确实能被未授权方触发并造成危害。Atomic框架利用自然语言处理和机器学习技术,从LTE NAS规范的549页、13,598条句子和283,850个单词中自动扫描提取HI。然后对HI进行解析和分析,恢复状态和事件信息,生成测试用例。这些测试用例在LTE仿真环境中自动执行,检测系统是否允许危险操作在缺乏适当保护的情况下发生。实验在不到5小时内从192个HI中发现了42个漏洞,其中10个是此前未报道过的,涉及两种威胁模型。所有漏洞均通过端到端攻击验证,可导致合法用户设备的LTE服务被未经授权中断。作者已向相关方报告,并获得主要商业运营商确认存在以及Google的2000美元奖励。

💡 推荐理由: 该研究展示了利用文档自动发现协议漏洞的新范式,可大幅提升蜂窝网络等复杂系统的安全分析效率。

🎯 建议动作: 纳入内部评估

排序因子: 来自网络安全顶级会议 (+8) | Community 数据源 (+1) | LLM 评分加成 (+0.7)