#detectability

共收录 1 条相关安全情报。

← 返回所有主题
👥 作者: Zeyan Liu, Zijun Yao 0001, Fengjun Li, Bo Luo

随着ChatGPT等大型语言模型(LLMs)在学术写作中的广泛应用,如何检测LLM生成的内容成为学术界关注的焦点。本文系统研究了ChatGPT生成内容在学术文献中的可检测性,特别是科学论文摘要。作者首先构建了GPABench2基准数据集,包含超过280万对比样本,涵盖人类撰写、GPT生成、GPT补全和GPT润色四种类型的摘要,涉及计算机科学、物理学及人文社会科学三个学科。其次,作者探索了检测方法:评估了现有检测工具和超过240名人类评审者的不佳表现,然后基于手工设计的语言学特征模型作为基线,开发了名为CheckGPT的深度神经网络框架,旨在捕捉ChatGPT写作中微妙的深层语义和语言模式。最后,通过跨学科、跨任务的全面实验验证了CheckGPT框架的有效性,并评估了其迁移性、对提示工程的鲁棒性等。研究结果表明,现有工具和人类难以可靠区分ChatGPT生成内容,而CheckGPT在多种任务上表现更优。这项工作为学术圈制定LLM使用政策提供了数据和方法支持。

💡 推荐理由: ChatGPT在学术写作中的滥用威胁学术诚信,本文提供了大规模基准数据集和高效检测框架,帮助期刊、会议和科研机构识别AI生成内容,维护学术评价体系的公正性。

🎯 建议动作: 研究跟进

排序因子: 来自网络安全顶级会议 (+8) | 命中热门研究主题 (+2) | Community 数据源 (+1) | LLM 评分加成 (+0.5)