基于神经网络的跨语言摘要生成中的源语言语义保真与目标语言流畅性平衡研究综述.docVIP

  • 1
  • 0
  • 约5.25千字
  • 约 7页
  • 2026-09-25 发布于江苏
  • 举报

基于神经网络的跨语言摘要生成中的源语言语义保真与目标语言流畅性平衡研究综述.doc

基于神经网络的跨语言摘要生成中的源语言语义保真与目标语言流畅性平衡研究综述

跨语言摘要生成(Cross-LingualSummarization,CLS)旨在将不同源语言的长文本压缩为符合目标语言表达习惯的短摘要,同时保留核心语义信息,是自然语言处理领域连接多语言信息流通的关键任务。随着预训练语言模型的大规模应用,神经网络CLS系统的性能得到了显著提升,但核心矛盾始终围绕源语言语义保真度与目标语言流畅性的动态平衡展开:过度追求语义保真易导致翻译腔严重、语句生硬,而过度强调流畅性则可能出现核心信息丢失、摘要偏离原文主旨的问题。近年来,相关研究围绕这一矛盾从模型架构、训练策略、评估机制等多个维度展开探索,逐步形成了多维度的平衡技术体系。

一、语义保真与流畅性矛盾的技术根源

跨语言摘要任务的双重属性是矛盾产生的根本原因:其同时具备“摘要”的信息压缩属性与“跨语言”的语义转换属性,两个目标的优化方向存在天然张力。从信息论角度看,源语言文本的语义空间与目标语言的表达空间并非完美同构,部分源语言特有的文化概念、专业术语、语境依赖信息在目标语言中缺乏直接对应表达,压缩过程中进一步放大了信息映射的难度。

从神经网络模型的内部机制看,早期基于编码器-解码器架构的CLS模型普遍存在“语义漂移”问题:编码器在对源语言文本进行编码时,会将表层语言特征与深层语义特征混合编码,解码器在生成目标语言文本时,

文档评论(0)

1亿VIP精品文档

相关文档