摘要
古文相较于现代文不仅在用词、语法等方面存在巨大差异,还缺少标点,使人难以理解语义。采用人工方式对古文进行标点既需要有较高的文学水平,还需要对历史文化有一定了解。为提高古文自动标点的准确率,将深层语言模型BERT与双向长短记忆网络和条件随机场模型(BiLSTM+CRF)相结合建立新模型,并提出新的数据预处理方法。该模型在古文自动标点上的各项性能指标均能达到85%左右,比常用方法提高了8%左右。同时,该模型也表现出较好的泛化性能,即使在从未训练和预测过的古文数据集上各项指标也能达到78%左右。实验结果表明,该模型和新的预处理方法不仅能够更好地学习古文的语义信息和上下文关联信息,还能够学习标签
您可能关注的文档
最近下载
- 小学三年级上册写字表字帖(可打印).pdf VIP
- 2026年中国医疗保健国际交流促进会招聘笔试参考题库及答案解析.docx VIP
- 行测常识判断经济学常识100题.doc VIP
- [全国卷]CSP-J 2023年初赛真题试卷.pdf VIP
- 软考—系统分析师—考点汇总.doc VIP
- 治安调解协议书7篇.docx VIP
- T_CCSAS 007-2020 化工企业变更管理实施规范.pdf VIP
- T_CRES 0019-2023 风力发电机组 叶片螺栓组件.pdf VIP
- 六年级上册部编版《桥》课件(2套).pptx
- 2026年中国医疗保健国际交流促进会招聘笔试参考题库及详细答案解析.docx VIP
原创力文档

文档评论(0)