基于神经网络的文本摘要生成中的关键信息选择与冗余消除策略研究综述.docVIP

  • 0
  • 0
  • 约4.17千字
  • 约 5页
  • 2026-09-25 发布于江苏
  • 举报

基于神经网络的文本摘要生成中的关键信息选择与冗余消除策略研究综述.doc

基于神经网络的文本摘要生成中的关键信息选择与冗余消除策略研究综述

一、关键信息选择的核心范式演进

1.抽取式范式下的信息打分机制

早期基于神经网络的抽取式摘要方法将关键信息选择转化为句子级二分类任务,通过为每个句子计算重要性得分完成筛选。2015年提出的SummaRuNNer模型首次将循环神经网络(RNN)应用于句子排序任务,通过双向GRU编码上下文语义,同时引入位置特征、词频特征等人工特征辅助打分,在CNN/DailyMail数据集上实现了ROUGE-1得分39.6%的突破。这类模型的核心逻辑是将“关键信息”等同于“语义独立且与主题高度相关的句子”,但存在明显局限性:无法捕捉句子间的语义关联,容易遗漏跨句子的复合型关键信息,且对长文本中的隐性重要信息识别准确率不足60%。

后续研究进一步引入注意力机制优化打分逻辑,2017年的Refresh模型通过层级注意力结构分别对词级和句子级语义进行编码,能够动态调整不同位置词语的权重,在法律文书摘要任务中,将关键条款的识别准确率提升至72%。为了解决长文本依赖问题,部分研究开始结合图神经网络(GNN)构建语义关联图,将句子作为节点、语义相似度作为边,通过图卷积计算节点的重要性得分。2020年提出的GraphSum模型在处理超过1000字的科技论文摘要任务时,关键信息的覆盖率比传统RNN模型提升了14.3%,能够有效识别分散在多个段落中的

文档评论(0)

1亿VIP精品文档

相关文档