- 1
- 0
- 约1.38千字
- 约 9页
- 2026-08-21 发布于山东
- 举报
1基于PaddleHub的低俗文本审核
2任务描述社交媒体色情检测模型可自动判别文本是否涉黄并给出相应的置信度,对文本中的色情描述、低俗交友、污秽文案进行识别。在2017年之前,工业界和学术界对NLP文本处理依赖于序列模型?RecurrentNeuralNetwork(RNN).
3任务描述近年来随着深度学习的发展,模型参数数量飞速增长,为了训练这些参数,需要更大的数据集来避免过拟合。然而,对于大部分NLP任务来说,构建大规模的标注数据集成本过高,非常困难,特别是对于句法和语义相关的任务。相比之下,大规模的未标注语料库的构建则相对容易。最近的研究表明,基于大规模未标注语料库的预训练模型(PretrainedModels,PTM)能够习得通用的语言表示,将预训练模型Fine-tune到下游任务,能够获得出色的表现。另外,预训练模型能够避免从零开始训练模型。
4任务描述
5本项目本项目将采用百度出品的PaddleHub预训练模型微调工具,快速构建方案。模型方面则选择ERNIE模型。
6整体流程
7ERNIEvsBERTERNIE(EnhancedRepresentationthroughKnowledgeIntegration)和BERT是两个在自然语言处理(NLP)领域中广泛应用的预训练模型,它们有以下几个区别:1.预训练数据和任务:BERT使用大
您可能关注的文档
- 【自然语言处理实践01】基于统计的文本表示.pptx
- 【自然语言处理实践02】基于Word2Vec的文本表示.pptx
- 【自然语言处理实践03】基于预训练的文本表示.pptx
- 【自然语言处理实践04】基于BiLSTM的文本分类.pptx
- 【自然语言处理实践05】基于Attention机制的文本分类.pptx
- 【自然语言处理实践06】基于预训练-微调的文本分类.pptx
- 【自然语言处理实践08】基于表示(Representation)的文本匹配.pptx
- 【自然语言处理实践09】基于交互(Interaction)的文本匹配.pptx
- 【自然语言处理实践10】基于预训练-微调的文本匹配.pptx
- 【自然语言处理实践11】基于BiLSTM-CRF的命名实体识别.pptx
最近下载
- 孙柏瑛-公共部门人力资源开发与管理(第五版)第10章.pptx VIP
- 《体育教学法》课件——[1.5]小学体育课的类型和结构.pptx VIP
- 新解读《GB_T 8190.7-2018往复式内燃机 排放测量 第7部分:发动机系族的确定》.docx VIP
- 既有建筑外围护结构节能改造的全生命周期成本效益分析.pdf VIP
- 绵竹市城市总体规划(2008—2020).pdf VIP
- T∕ZZB 1243-2019 66kV~220kV交流电缆用交联聚乙烯绝缘料.docx VIP
- 初三化学备课组教学计划(九篇).doc VIP
- 高三物理直线运动和相互作用检测题.doc VIP
- GB7231-2016《工业管道的基本识别色、识别符号和安全标识》 GB 7231-2003文档撰写.pptx VIP
- WT819-A,19版技术说明书.pdf VIP
原创力文档

文档评论(0)