面向大模型预训练的俄语语料库构建研究.pdfVIP

  • 0
  • 0
  • 约4.08万字
  • 约 13页
  • 2026-09-08 发布于山东
  • 举报

面向大模型预训练的俄语语料库构建研究.pdf

信息技术2026年第2期93

面向大模型预训练的俄语语料库构建研究*

张涛张鹏轩马海群蔡庆平

(黑龙江大学信息管理学院哈尔滨150080)

摘要[目的/意义]随着大模型技术的不断发展,解决语言表示和效率的不平衡问题变得至关重要,而

构建高质量的语料库是推动数据开放利用的关键环节。[方法/过程]本研究以大模型预训练及语料库应

用为目标,构建涵盖数据模块、语料库模块、数据库模块、预训练模块和微调模块的俄语语料库。预训练

模块借助Qwen、DeepSeek等大模型作为基线模型,通过无监督学习与多任务微调协同,紧密对接微调

模块中的学术术语问答、文本分类、中俄互译、情感分析等下游任务,为这些领域的实际应用提供坚实的

技术支撑,在推动各领域发展中发挥着关键作用。[结果/结论]通过本研究构建的俄语语料库,具备采集

更丰富多元数据的能力,能够融合多模态技术,进一步深化人工智能在俄语相关领域的应

文档评论(0)

1亿VIP精品文档

相关文档