笔记-abstract and introduction Crowdsourcing.docxVIP

  • 4
  • 0
  • 约3.53千字
  • 约 3页
  • 2018-11-16 发布于贵州
  • 举报
01 众包网络上的翻译任务 提出一个关于此的”合作工作流”,以应对这些挑战 在我们的流水线模型中,翻译人员之前工作阶段的输出结果在随后的翻译阶段可以得到巩固或者改善。我们同样强调流水线模型的新颖的贡献比如辅助翻译以及能够同时利用一种语言或者双语人员的翻译合成。评估方式为:抽出少数-多数语言对和少数-少数语言对的翻译。 对于新的语言对产生的大规模的并行数据,需要大量的人力以及专家的参与。对于大多数的语言翻译,由于专业翻译的稀缺甚至难以找到双语者(能够说两种语言的人)使得构建统计的机器翻译系统(使用大量的平行数据为语言翻译训练数学模型)十分困难和昂贵。因此,只有一小部分的语言有自动翻译系统。如果我们可以使用众包来得到语言对的翻译,那么对于构建大部分语言的翻译系统的成本能够大幅缩减。 为构建自动翻译系统,对于新的语言对产生的大量的平行数据,传统的依靠少数专家和双语者(能够说两种语言的人)来完成翻译任务既十分困难又花费昂贵。为此,采用众包方式来完成这个任务如果可行则能够解决“成本”和“为大多数语言构建翻译系统”这两大挑战。 众包在单语言环境中虽被广泛采用,比如抽取一个具体的标注标签。但是迄今在分析众包用于抽取结构化的标注的适用性方面却少有研究,比如:为一篇文章写总结,将一句话翻译成其他语言,顺序标签,对句子进行语法分析等等。 02 03 04 05 关于微任务市场的任务推荐 随着研究者对于

文档评论(0)

1亿VIP精品文档

相关文档