机器翻译中汉语动结式生成的过程和困难文,计算机,.docVIP

机器翻译中汉语动结式生成的过程和困难文,计算机,.doc

  1. 1、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。。
  2. 2、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载
  3. 3、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
  4. 4、该文档为VIP文档,如果想要下载,成为VIP会员后,下载免费。
  5. 5、成为VIP后,下载本文档将扣除1次下载权益。下载后,不支持退款、换文档。如有疑问请联系我们
  6. 6、成为VIP后,您将拥有八大权益,权益包括:VIP文档下载权益、阅读免打扰、文档格式转换、高级专利检索、专属身份标志、高级客服、多端互通、版权登记。
  7. 7、VIP文档为合作方或网友上传,每下载1次, 网站将根据用户上传文档的质量评分、类型等,对文档贡献者给予高额补贴、流量扶持。如果你也想贡献VIP文档。上传文档
查看更多
机器翻译中汉语动结式生成的过程和困难文,计算机,.doc

机器翻译中汉语动结式生成的过程和困难论文,计算机论文论文,... 机器翻译中汉语动结式生成的过程和困难  电视看久了。 to watch TV for a very long time.   我英语学晚了。 It was very late when I started to learn English.   还有,致使“动作—结果”事件发生的某些因素在汉语里常常可以充当动结式的一个论元角色,(注:袁毓林(2001)称其为外来的致事。)而在英语里它们往往充当其他成分:   那场可怕的暴风雪冻死了不少人。Many people froze to death in the terrible snowstorm.   沙发把你坐懒了。You are becoming lazy on the sofa.   所以我们需要一组规则,在要生成的语义表达式里判断有没有应该用汉语动结式表达的述谓关系。在这组规则里,除了两个谓词结构及其显性的“动作—结果”关系符合判断条件以外,还应该有能够识别和提取隐含的“动作—结果”关系及其述谓结构的条件。这就需要研究英语和汉语在表达“动作—结果”关系时的差异。这种差异有时在某种类别下表现出来,有时又很个性化,只跟具体词语有关。目前机器翻译系统还没有找到这样的规则。所以我们就暂时只能看到“她嫁给了错误的人”和“他进了错误的门”这样的译文。     3.2 选择词语   选择词语需要有一部用于信息处理的汉语词典,告诉我们词语和它们的意义,以及它们的用法(比如,谓词的配价结构及其论元的限制条件)。对于前面的例子,需要先在词典里选出“小王”、“读”、“懂”、“文章”这些词,然后根据词语的意义和逻辑关系为它们分派语义角色。这些词在中介语言逻辑表达式里是实体和谓词。“了”、“结果”、“这”等是算子或关系,把它们转成词汇形式还需要另外的分析和处理。词语选择和语义角色分派的结果可以表示成树形图或特征集合等形式。   附图     图2 词语选择和角色分派的结果     Agen表示施事,Pred表示谓词,Pati表示受事,Cont表示内容,Expe表示经验者(当事)。   即使有一部详尽的词典,要让机器根据意义选择词语也不是一件容易的事情。我们经常需要在几个同义词或近义词当中进行取舍。比如,汉语的“看”有read的意思,用它来表达我们要生成的意思比“读”更地道。根据什么样的规则选择“看”,不选择“读”?目前汉语词汇和语义的研究还不能形式化地回答这个问题。机器翻译系统只好先根据词语搭配的优先关系来判断。一种作法是,借助描写词语概念的语义词典,用统计语言模型计算语义相似度,让计算机学会表示和比较词语搭配的优先关系。但是,用这种工程化的方法并不能绕过汉语研究的作用,因为一个统计语言模型能否达到比较好的处理效果,很大程度上取决于采用什么样的语言学知识作为参数。     3.3 判断合法性   经过词语选择和角色分派,得到了图2表示的两个谓词结构。这一步的任务是,判断能不能用动结式述语结构表示这两个谓词结构及其关系。具体说就是,“看”和“懂”能不能合成“看懂”,并且表示中介语言逻辑表达式要求的“动作—结果”关系。因此合法性的问题关系到哪些动词和哪些形容词(或动词)能够组合成符合汉语习惯的动结式。   如果给机器翻译系统提供一个词表,列出一批动结式的词语,而“看懂”又刚好在这个词表里,那么判断这件事情就比较容易。譬如,在动词“学”的两个义项(“学习”和“模仿”)下面,《汉语动词用法词典》(孟琮等,1999)列举了8个动结式实例,《中国语补语例解》(侯精一等,2001)列举了12个。这两部词典是面向人的,如果给机器翻译用就还需要收录更多的实例。比如“学懂”、“学腻”,等等(我们在本文的第四部分列举了“学”下面84个可能需要生成的动结式实例)。实际上,词表只适用于小范围的实验型翻译系统。动结式述语是一种自由结构,是根据说话的需要临时造出来的,因此应该是不胜枚举的。   我们可以这样想,“学”是一种认知行为,“懂”、“明白”等词语表示认知活动的效果,因此可以当“学”的结果补语。但人们也常说“这孩子学歪了”、“把身体学垮了”。“歪”和“垮”又根据什么是“学”的结果补语呢?这些补语该用什么条件来生成?我们将在第四部分进一步讨论这个问题。   如果这一步判断的结果是不能生成合法的动结式,那么就需要回到上一步,重新选择词语,直到找不到符合预定的语义要求的词语为止。     3.4 整合语义结构   作为一个述谓性的结构整体,动结式有自己语义上的支配成分,包括论元成分和附加成分,我们把这些语义关系的和统称为语义结构。在这一步,我们需要根据动词和补语各自的语义结构,确定动结式整体的语义结构,主要是配价结构(价语的数量和性质)。   动结式的配价结构不等

您可能关注的文档

文档评论(0)

lnainai_sj + 关注
实名认证
文档贡献者

该用户很懒,什么也没介绍

1亿VIP精品文档

相关文档