- 1
- 0
- 约1.47千字
- 约 10页
- 2026-08-21 发布于山东
- 举报
1基于预训练-微调的中-英机器翻译
2预训练+微调的范式目前绝大多数AI任务都是建立在数据的基础之上的统计学习,模型的表现效果很大程度上依赖于数据的质量和数量。利用大量较易获得的无标注语料上来预训练模型,在具体应用场景下游任务上再利用少量标注数据微调来实现实际场景可用的自监督表示学习模型,已经成为自然语言处理领域的一种新的成功范式。例如BERT在大规模纯文本上预训练后,在自然语言理解的11项任务上少量微调就能取得很好的成绩。已有的生成式预训练模型如MASS、UniLM、BART等,将MaskLM学习任务和seq2seq框架结合,在一系列自然语言生成任务上取得了SOTA的研究成果。但是这些预训练模型很少关注自然语言生成中的曝光偏差问题。
3MASS/BART
4MASSTransformer架构(encoder-decoder)seq2seq框架(encoder-decoder)MASS对句子随机屏蔽一个长度为k的连续片段,然后通过编码器-注意力-解码器模型预测生成该片段。如上图所示,编码器端的第3-6个词被屏蔽掉,然后解码器端只预测这几个连续的词,而屏蔽掉其它词,图中“_”代表被屏蔽的词。
5BARTBART模型在微调阶段应用于机器翻译任务时,具体的做法是将BART的encoder端的embedding层替换成randomlyinitializedencoder,新的enc
您可能关注的文档
- 【自然语言处理实践01】基于统计的文本表示.pptx
- 【自然语言处理实践02】基于Word2Vec的文本表示.pptx
- 【自然语言处理实践03】基于预训练的文本表示.pptx
- 【自然语言处理实践04】基于BiLSTM的文本分类.pptx
- 【自然语言处理实践05】基于Attention机制的文本分类.pptx
- 【自然语言处理实践06】基于预训练-微调的文本分类.pptx
- 【自然语言处理实践07】基于PaddleHub的低俗文本审核.pptx
- 【自然语言处理实践08】基于表示(Representation)的文本匹配.pptx
- 【自然语言处理实践09】基于交互(Interaction)的文本匹配.pptx
- 【自然语言处理实践10】基于预训练-微调的文本匹配.pptx
原创力文档

文档评论(0)