#scam-detection

共收录 3 条相关安全情报。

← 返回所有主题
👥 作者: Pujan Paudel, Gianluca Stringhini

本文提出 LOKI 系统,旨在主动发现电商诈骗网站。当前诈骗网站检测依赖用户举报(被动且滞后)或搜索引擎主动查询(覆盖率低、泛化差)。LOKI 通过挖掘搜索引擎中有毒的搜索查询(即那些可能返回大量诈骗网站的查询词)来解决候选网站发现瓶颈。核心方法基于学习特权信息(LUPI)和搜索结果页面特征蒸馏,训练关键词评分模型。在10大诈骗类别(如购物诈骗、宠物诈骗等)上验证,与启发式和数据驱动基线相比,发现效率提升20.58倍。仅需1663个已知诈骗网站作为种子,即可发现52493个未被报告的诈骗站点。此外,LOKI 能泛化到未见过的诈骗类型,适合发现新型威胁。论文贡献在于提出了一种主动、高效且可扩展的诈骗网站发现框架,填补了被动检测与主动发现之间的空白。

💡 推荐理由: 突破被动依赖举报的局限,通过挖掘搜索引擎有毒查询主动发现诈骗网站,效率提升20倍,能持续发现新威胁,适合安全团队用于提前预警。

🎯 建议动作: 研究跟进,评估其方法在自有威胁发现流程中的适用性

排序因子: 来自网络安全顶级会议 (+8) | Community 数据源 (+1) | LLM 评分加成 (+0.5)
👥 作者: Cem Topcuoglu, Seyed Ali Akhavani, Harel Berger, Sadia Afroz, Michalis Pachilakis, Vibhor Sehgal, Leyla Bilge, Engin Kirda

本文研究生成式AI模型(尤其是大语言模型,LLM)在在线诈骗检测中的性能。尽管LLM已被集成到多种安全产品(如邮件网关、浏览器扩展、欺诈监控面板)中,但业界普遍认为它们广泛适用于诈骗检测,却缺乏系统的实证评估。作者收集并整理了一个包含多种格式和话题的真实世界诈骗基准数据集,涵盖不同类型的欺诈场景。他们评估了9种不同规模和架构的LLM(包括GPT、Llama等),采用不同提示策略(如零样本、少样本、链式思考等),并与一个经过微调的BERT分类器进行对比。实验结果表明:更大规模的LLM总体上表现更好,但有效的提示设计能显著提升小型模型的性能;更重要的是,LLM在泛化到未见过的诈骗类型方面优于微调的BERT模型,这表明预训练知识对诈骗检测有实质性的贡献。作者公开了数据集和评估框架,以促进未来基于语言模型的鲁棒诈骗检测研究。本文适合安全研究人员、AI工程师和欺诈检测领域的从业者阅读,尤其是在评估LLM在实际部署中的适用性时具有参考价值。

💡 推荐理由: 本研究为热门的LLM安全应用场景(诈骗检测)提供了首个系统基准,揭示了模型选择与提示设计的关键影响,有助于安全团队理性选用AI防御方案。

🎯 建议动作: 研究跟进

排序因子: 影响边界/网络设备 (+5) | 来自 arXiv 其他板块 (+2) | 命中热门研究主题 (+2) | Community 数据源 (+1) | LLM 评分加成 (+0.5)
👥 作者: Ahmed Omar Salim Adnan, Yogananda Manjunath, Shivanjali Khare

该论文针对生成式人工智能背景下日益严重的对话式诈骗威胁提出了一种可解释的智能体系统。对话式诈骗通常持续数周或数月,逐步建立信任后索取金钱或敏感信息,而现有检测系统主要关注孤立信息,难以应对此类复杂攻击。本文首先扩展了单消息钓鱼检测,构建了一个基于智能体的检测系统,该系统利用摘要式记忆机制在对话层面进行推理,并能够提供解释。论文还发布了首个公开的多类别对话式诈骗基准数据集ConScamBench-278,涵盖8种诈骗类型,支持可重复评估。实验结果表明,在孤立消息上,单消息检测器实现了100%的钓鱼召回率;在对话级别检测中,该系统识别出LoveFraud02语料库中的所有诈骗(83/83),并在ConScamBench-278上达到97.8%的准确率(95% CI [95.4, 99.0])。此外,两项用户研究(N=100和N=45)显示,参与者在判断可疑对话时经常感到不确定;在无对照的前后比较中,用户对基于AI的诈骗检测的信任度、自信心和感知需求均显著增加(p < 0.001, Wilcoxon符号秩检验)。系统可用性量表得分为74.7(95% CI [72.5, 76.9]),高于公认的可用性基准。该工作强调了可解释性和对话上下文的重要性,为应对基于LLM的社交工程攻击提供了新思路。适合安全研究员、反欺诈工程师以及LLM安全从业者阅读。

💡 推荐理由: 对话式诈骗正借助生成式AI变得更难检测,现有系统往往忽略上下文。本文提出的可解释智能体系统结合摘要记忆,能有效识别长期骗局并给出解释,对提升蓝队对抗社交工程攻击的能力具有直接参考价值。

🎯 建议动作: 研究跟进:评估该方法在自身业务对话数据上的迁移效果,并考虑集成可解释性模块。

排序因子: 来自 arXiv 其他板块 (+2) | Community 数据源 (+1) | LLM 评分加成 (+0.5)