基于BERT的上市公司年报情感词典构建.docxVIP

  • 0
  • 0
  • 约7.06千字
  • 约 13页
  • 2026-08-10 发布于上海
  • 举报

基于BERT的上市公司年报情感词典构建.docx

基于BERT的上市公司年报情感词典构建

引言

上市公司年报是资本市场信息披露的核心载体,不仅包含量化的财务数据,也蕴含着大量定性的文本信息,这些文本信息往往能够反映公司的经营状况、管理层预期以及潜在风险,是市场参与者决策的重要参考。随着资本市场的不断发展,传统仅依赖财务数据的分析方法已经难以满足各方对信息深度挖掘的需求,文本情感分析作为非结构化信息处理的重要技术,逐渐被应用到年报信息挖掘中。已有研究表明,上市公司年报中的文本情感倾向与公司未来业绩表现、二级市场股价波动均存在显著的相关性,挖掘年报中的情感信息能够为市场参与者提供财务数据之外的增量信息(李心丹等,2021)。

情感词典是情感分析的基础工具,其质量直接决定了情感分析的效果。然而,当前主流的通用情感词典大多基于通用文本构建,难以适配上市公司年报这类专业性强、表达委婉的金融文本,导致情感识别的准确率偏低。而传统的金融情感词典大多依靠人工构建或规则匹配,存在更新速度慢、语境感知能力弱等问题,无法充分挖掘年报中隐含的情感信息。近年来,以BERT为代表的预训练语言模型快速发展,凭借其强大的双向语义理解能力,为领域专属情感词典的构建提供了新的技术路径。基于BERT构建上市公司年报专属情感词典,不仅能够提升年报情感分析的准确性,还能为资本市场的监管、投资、信息披露优化等多个场景提供技术支撑,具有重要的理论与实践价值。

一、上市公司年报

文档评论(0)

1亿VIP精品文档

相关文档