生成式AI学术文本抄袭智能溯源检测方法.docxVIP

  • 1
  • 0
  • 约4.34千字
  • 约 6页
  • 2026-07-27 发布于浙江
  • 举报

生成式AI学术文本抄袭智能溯源检测方法.docx

生成式AI学术文本抄袭智能溯源检测方法

摘要:生成式人工智能产出的学术文本在词汇、句法层面高度流畅,传统基于字符串匹配的查重手段面临失效风险。本文聚焦生成式AI学术文本抄袭智能溯源检测方法,系统分析语义表征偏移、文体指纹异常及跨模态溯源等关键检测维度。探讨基于大规模语言模型微调的文本鉴别器、检索增强溯源验证及多特征融合判定框架,旨在构建高精度、可解释的学术诚信守护体系,为期刊评审、学位论文审查提供客观技术基准。

关键词:生成式AI;学术抄袭;智能溯源;文本检测;大模型微调

第一章生成式AI学术文本抄袭的形态演化与检测挑战

生成式预训练模型凭借海量学术语料训练,已具备模仿论文摘要、文献综述乃至实验论述的能力,由此催生的新型抄袭形态对传统审查制度构成严峻挑战。在抄袭形态演化方面,最表层的是提示词直接搬运,即使用者将他人已发表论文片段输入模型要求改写,产出词汇替换但逻辑结构高度同构的文本,此类文本避开了字面重复却窃取了智力贡献。更深层的则是思想隐形剽窃,模型在未显式引用的情况下,将训练语料中若干文献的核心假设、论证路径及数据解读范式重组输出,由于训练数据不透明,原作者难以举证。还有数据伪造型抄袭,模型生成看似合理的实验数据集、统计分布与图表描述,审查者若仅看文字无法识破。在检测挑战方面,首先是语义鸿沟问题。传统查重软件依赖n元语法重叠,而生成式文本通过同义置换、句式重组可将重叠率压至百

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档