本文节选自许明等著(2020),《计算机辅助口译学习系统研究》,pp.59-73,转载须注明出处。
机器翻译译文质量评估:参数设计与量化标准
许明、黄坤、邢红芳、崔赫、杨梦环、王亚宁、刘佳俊、魏星、李萌萌
北京语言大学
摘要:此文重新梳理了翻译理论层面译文质量评估的现有标准,并进而结合机器翻译的实际需求,探究、提出了神经机器翻译译文质量人工测评的评测维度和量化方法。论文还结合学术类语篇的测评结果,质化分析了现有机器翻译中存在的主要问题与不足。
关键词:机器翻译;译文质评估;人工测评;评估标准。
引言
机器翻译译文质量评估分为机器自动测评和人工测评两类。其中,业内关注较多的是前者,较成熟的评测方法有基于BLEU 值和基于 METEOR 两种,后者的研究相对较少。
2012 年,中科院计划自 2013 年起在全国机器翻译研讨会的机器翻译测评中引入人工测评,参评单位参与进行人工评价(吕雅娟,2012 )。人工评价方法主要从流利度(和忠实度)、可接受度、基于排序的方法对译文展开测评。其中,忠实度主要对意义进行评判,流利度主要评测语言的连贯及其与英语母语表达习惯的契合度,可接受度从信息保持、可理解度、合语法程度、流利度等方面,排序是指对若干个机器翻译译文进行优劣排序。上述各个评测环节均采用 5 分制。
现有人工测评方法在评测标准选择、标准界定、标准界限划分、标准层次设计等方面存在诸多不足。而且随着算法的改进不断更新,机器翻译译文质量也有了显著提升,译文质量评估标准需要适应机器翻译发展的现状。
一、 理论基础
对于笔译而言,译文质量评估需要注意四个大前提。其一,翻译是一个交际过程、是一种特殊的话语交际行为,根据释意理论,翻译的目的在于“ 在理解的基础之上使人理解” ,这个交际过程由话语发出者、信息、传播媒介、话语接收者等几个主要交际要素构成,交际是否成功的关键在于话语交际双语能否借助信息传递传达交际意图、实现交际目的。其二,翻译活动传递的是信息而不是词语,信息不是n 个词所对应的概念的集合,而是一个有机联系的整体;笔译翻译的是一篇文本不是单独的一个词、一个词组和一句话;口译翻译的是一段话语而不是独立的某一个词、短语或一句话。其三,词是概念的载体,信息的基本单位是概念,一个意义单位或一个信息单元是为了阐明一个概念的发展变化过程或表明若干概念之间的联系。其四,话语理解的本质是建立局部语篇连贯和整体语篇连贯,语言表达过程中所使用的语言不连贯或者理解过程中不能建立起连贯的表征就不能让人理解、不能达到好的话语交际效果。
结合翻译学的主要翻译理论,可以提炼出如下几条译文质量评估的标准。一是准确度,即译文在词汇的使用、句法的规范与组合、意义表达层面的准确性;二是契合度(Nida ,1964 ),即源语与译语间信息的吻合度;三是,透明度,对应跨文化交际中的异化;四是可读性或清晰度(Delisle, 1993 ),意即通过连贯与衔接来保障信息的内在逻辑和信息的灵活多样性;五是,可接受度(Toury ,1995 ),关键看译文是否吻合译入语文化和表达习惯;六是流畅度,主要察看译入语的连贯和地道程度;七是译语的交际功能或者说交际效率,主要是看译文能否达到交际目的。
机器翻译译文评估需要同时关注意义的传递、语篇的整体性以及每个意义单位的完整性。优质的译文应该是一个有机连贯的整体,能完成信息传递的功能、达到交际的目的,同时兼顾文本内部的互文性、文本的功能性(functionality ),并尽可能保留原文的形式与风格(许明,2011 )。
二、研究方法
1. 研究目的
此研究的主要目的是确定机器翻译译文质量评估的评测维度和量化方法。
2. 研究材料
语料均是在语篇测试的前提下展开,测试材料为学术类语篇,语篇来自航空、生物、计算机、法律、心理学、政治经济学六个领域,六个领域的语篇均为ISSCI 来源期刊,写作质量较高,翻译结果提取自谷歌、百度、翻译君和有道的机器翻译。
3 、研究步骤
为保证文本的连贯性,在进行机器翻译前,剔除掉了文章的标题、文内注释、加注等内容,然后将文本整体输入翻译引擎。之后,筛选翻译错误,分别对不同主题的译文进行人工错误分类。综合六大学术语篇的所有错误,进行聚类分析,按照出现的频率和重要性确定判定标准。
三、研究结果
(一)、机器翻译译文质量评估的前提和路径
考虑到语篇作为语言单位的特殊性及其对机器翻译译文的影响,机器翻译译文质量评测以语篇为单位来展开,在语篇的基础上完成机器翻译,之后对语篇进行单句切分,将能传达一个完整意义单位的句子为评测单位。
(二)、机器测评量化标准与层级划分
根据机器翻译现有的质量和适用领域等特点,机器翻译译文质量评估从可理解度(understandability )、准确度(accuracy )和贴切度(appropriateness )三个维度来衡量。依据上述三个维度,我们将机器翻译译文质量切分为如下五个层级:精确、准确、可理解、部分可理解和不可理解五个层面。

图3:机器翻译译文质量评估标准与层级划分
三个衡量维度中的可理解度的具体衡量标准为:能完整传达信息、表意功能明确,能基本达到交际目的,忽略部分语法、词法、搭配等错误。这一层面的关键判别点包括:逻辑(关键衔接与连贯)、术语、忠实度等。准确度的衡量标准是:不存在错译、漏译、增译等现象,能忠实、完整传递译文信息;不存在句序逻辑问题,术语、关键词翻译准确,句式有适当变化(不影响与原语的忠实度),不存在单复数、代词、连词等问题。关键判别点包括:选词、语法等问题。贴切度的衡量标准:语言地道程度、母语表达习惯、语域、风格等。
精确译文是指:译文吻合目的语的表达习惯,与所使用的语境吻合,与原语风格一致,能体现出语域特征。
准确的译文是指不存在错译、漏译、增译等现象,能忠实、完整传递译文信息;不存在句序逻辑问题,术语、关键词翻译准确,句式有适当变化(不影响与原语的忠实度),不存在单复数、代词、连词等问题。
可理解的译文一般存在不影响关键理解的错译、漏译和增译现象,如:在词法方面,存在部分术语瑕疵、用词不当、词序颠倒、单复数错误、关联词错误、连词缺失、动词并列、名字错误、缩略语错误、量词确实特殊格式错误等;在句法层面,存在局部内在逻辑错误、与源语有逻辑差异、断句、主谓搭配、衔接、语法、时态、语态等非关键性错误;在句子层面,漏译部分不重要内容和局部次要信息等。
部分可理解的译文存在半数及以上的翻译错误,局部翻译可接受;在词法层面,存在术语瑕疵、关键词用词不准确、存在词序错误、较严重的用词不当、名词限定结构内部逻辑错误以及其他动词搭配、代词指代不清、数字错误、修饰限定成分错误、副词位置等错误;在句法层面,存在句序逻辑错误、句子成分缺失、错乱、不忠实于原文、主语不明确、多重谓语、衔接等问题。漏译部分信息、漏译关键词、漏译主语、漏译名词、形容词等非主要内容等
不可理解的译文存在严重错译,漏译或者增译现象,如,在词法层面,存在术语翻译错误,关键词、中心词翻译错误,存在不可理解的语义、语法错误以及其他造成不可逾越的理解障碍的错误,如关联词、转折词、介词;在句法层面,存在较为严重的逻辑错误、断句错误、不忠实于原文、缺失谓语等句子成分、主谓不匹配、严重的时态、语态错误以及其他严重影响理解的处理错误,如主语译为独立句子、限定转为并列、成语、谚语等固定用语翻译错误;漏译句子、术语、核心词和主要内容等。
表5:机器翻译译文质量评估明细指标
| 一级指标 | 二级指标 | 三级指标(按照重要性排序) |
| 错译 | 句法 | 1 、句序、逻辑;2 、断句;3 、句子成分残缺或错乱颠倒;5 、原文、译文的忠实度;6 、句子衔接;7 、时态、语态、语气;8 、主谓不搭配;缺少、重复谓语;9 、缺少主语;10 、成语、谚语翻译不准确;11 、其他特殊现象。 |
| 词法 | 1 、术语、缩略语;2 、关键词、核心词;3 、选词;4 、词序;5 、名词限定结构;6 、动词搭配;7 、数字;8 、关联词;9 、转折词;10 、标点符号;11 、单复数;12 、介词、代词、副词、量词、范畴词等;13 、限定成分;14 、特殊格式。 | |
| 漏译 | 1 、漏译句子;2 、漏译术语;3 、漏译核心词;4 、漏译主要内容;5 、漏译部分信息;6 、漏译部分次要信息;7 、漏译主语;8 、漏译修饰语;9 、漏译名词、形容词等。 | |
| 增译 | 1 、加词;2 、增加多余成分;3 、重复翻译。 |
(三)、评测步骤
译文质量测评过程中,首先对句子按照可理解度进行可理解与不可理解的测评。评判围绕错译、漏译、增译三个角度展开,不可理解的句子主要看是否存在严重漏译、增译、术语、关键词翻译错误、是否存在逻辑、句序错误(如断句不准确、成分残缺)等。之后,再分别从句法(逻辑)、忠实度(信息传递)、词法(精确度)三个层面进行评判,以能否达到交际目的为最终标准。
四、错误类型实例分析
(一)、不可理解的译文
1. 术语或关键词错误
在例1 中,原文是与“ 铝” 合金化的“ 镁” 而译文分解成了“ 铝合金与镁合金” 。术语“ 镁” 及“ 合金化” 错误,导致整句翻译出现问题,与原文出入较大。
例1 :
原文:目前,与铝合金化的镁约占镁合金应用总量的43% ,
译文:At present, aluminum alloy and magnesium alloy account for about 43% of total applications.
在例2 中,译文错译关键词“ 人格权” 、“ 支配权” 以及“ 支配性” ,三个关键词错误导致译文无法理解,无法准确传达原文意义。
例2 :
原文: 人格权的支配性与支配权的支配性有本质差异。
译文:First, there are essential differences between the domination of personality and that of domination.
例3 :
原文: 刑法上侵害个人权益的禁止性行为,在民法上也属于禁止性行为。
译文: prohibited sexual acts that infringe on individual rights and interests in criminal law are prohibited sexual acts in civil law as well.
例3中,关键词“ 禁止性行为” 翻译错误,译文中将“ 禁止性行为” 一个词拆成“ 禁止” 、“ 性” 、“ 行为” 三个词进行翻译,容易让读者摸不着头脑,难以理解译文。
2. 逻辑结构混乱
在例4 中,原文的逻辑是:在商用飞机与汽车减去相同质量的条件下,商用飞机的燃油费用的节省是汽车燃油费用节省的近100 倍。而译文逻辑不清晰、较为混乱:未能将“ 商用飞机与汽车减重相同质量” 这一意义单位表示出来,由此所带来的“ 燃油费用节省” 这一逻辑关系也没有表示出来。由此导致译文逻辑混乱、难以理解。
例4 :
原文:商用飞机与汽车减重相同质量带来的燃油费用节省,前者是后者的近100 倍,
译文:Commercial aircraft and cars lose the same mass of fuel cost savings, the former is nearly 100 times the latter
例5 中,原文逻辑为: 镁合金变形件/ 塑性加工条件/ 控制困难,导致组织与力学性能不稳定,而译文译为:镁合金变形件塑性/ 加工条件控制困难,导致组织与力学性能不稳定。机器翻译译文未能处理好“ 塑性” 、“ 变形件” 、“ 镁合金” 和“ 加工条件” 还有“ 控制困难” 之间的关系,导致译语混乱,背离原文,打乱了原文内在逻辑及层次。
例5 :
原文:镁合金变形件塑性加工条件控制困难,导致组织与力学性能不稳定。
译文:plasticity of magnesium alloy deformed parts Difficult to control processing conditions, resulting in unstable tissue and mechanical properties.
例6中,原文逻辑的是:“ 机动性能改善” 可以“ 极大提高其战斗力和生存能力” ,而译文在“ 机动性能改善” 与“ 提高战斗力与生存能力” 间断句,插入了个句号,切断了前后的逻辑关系,且拆开翻译导致后一句句子结构不完整。
例6 :
原文:更重要的是其机动性能改善可极大提高其战斗力和生存能力。
译文:More importantly, its maneuverability can be greatly improved. Improve their combat effectiveness and survivability.
3. 关键句子成分错误
例7中,译文中主语翻译不完整,缺少关键词“ 规定” 没能翻译出来。主语这一关键成分缺失会给读者带来理解障碍,甚至造成理解上偏差和错误。
例7 :
原文: 此处采取的同样是 “ 定义 + 列举式” 规定。
译文: The same is taken here for the definition + enumeration.
例8:
译文: National protection can identify the personal identity of citizens and electronic information concerning the privacy of citizens.
4. 漏译关键信息
例9中,译文仅仅翻译了句子开头部分“ 信息主体” 和后半句“ 主旨在于……” ,漏译“ 对个人信息的支配主要体现为信息的使用” ,导致信息不完整,逻辑结构缺失。
例9 :
原文: 信息主体对个人信息的支配主要体现为信息的使用,主旨在于维护自身人格的自由发展。
译文:The main purpose of information subject is to maintain the free development of their personality
例10中,译文出现大部分漏译,漏译“ 本文从系统安全、网络安全以及应用安全三个研究领域” 前半部分,仅翻译了句子开头“ 接下来” 和后半部分“ 按照……” 。漏译关键信息,影响读者理解,未传递原文完整信息。
例10 :
原文:接下来本文从系统安全、网络安全以及应用安全三个研究领域,按照上述机器学习的一般流程,对机器学习在网络空间安全领域的典型应用进行了分析和讨论,
译文:Next, the typical applications of machine learning in Cyberspace Security are analyzed and discussed according to the general process of machine learning. 、
5. 原文与译文有较大出入
例11中,原文强调“ 环境对个体危害” ,而译语中直接译为“ 减少对个体的危害” ,省略了“ 环境” ,造成原文与译文有意义上的出入,一定程度上传达信息不完整。
例11 :
原文:因为这也许可以相对降低环境对个体的危害。
译文:because this may be relatively less harmful to the individual.
6. 成语、谚语等翻译错误
成语、谚语表达经典凝练,内含丰富中华文化内涵,对于机器翻译而言尚且存在很大难度,目前的神经机器翻译引擎尚且不能很好地对这一文化负载词进行翻译,故而其译文存在许多问题,尚不能准确传递意义与内涵。如,“举重以明轻” 译为:“Lifting weights are light and light 、Lifting weights lightly 或Weight lifting light” ,过犹未及译为:“is it too late 、 Is it too bad” 等。
7. 断句错误
例12中,原文的限定语过长、列举多,导致在翻译中中心词被割离。译文翻译为:“ 然后从系统安全、网络安全和应用安全三个层面,着重介绍了机器学习的网络空间安全领域在芯片及系统硬件安全、系统软件安全、网络基础设施安全、网络安全检测、应用软件安全、社会网络安全等。领域中的解决方案” 。
例12 :
原文:然后从系统安全、网络安全和应用安全三个层面,着重介绍了机器学习在芯片及系统硬件安全、系统软件安全、网络基础设施安全、网络安全检测、应用软件安全、社会网络安全等网络空间安全领域中的解决方案,
译文:Then from the three aspects of system security, network security and application security, it focuses on the network space security of machine learning in chip and system hardware security, system software security, network infrastructure security, network security detection, application software security, social network security, etc. Solutions in the field,
(二)、部分可理解的译文
部分可理解的译文是指:译文中包含部分错误信息,抑或译文部分信息与原文有出入的地方,不准确的地方。
1 .术语部分译出或翻译有瑕疵、关键词错误等
术语或专有名词翻译结果不是百分百准确,此类瑕疵在经过认知加工后可以理解。例:术语“ 巨自噬” 被译为“giant autophagy, mega autophagy” ,应为:“macroautophagy” 专有名词“ 越南总理” 翻译成“Vietnamese Prime Minister” ,应为:“Prime Minister of Vietnam” 。
翻译长限定结构的名词时,常出现名词罗列现象严重,并未译出原有限定结构与意义,致使该类名词翻译效果不佳。例:“ 镁合金低压铸造设备” 译为“magnesium alloy low-pressure casting equipment” ;“ 安全专家人工修复方法” 、“ 零日漏洞问题” 翻译分别为“ the safety expert manual repair method” 、“the zero-day vulnerability problem” ,“ 自噬分子机制调控” 译为“autophagy molecular mechanism regulation” 。
2 .缺少或错误使用谓语动词
例13 中,译文从句缺少谓语动词,应在“a large number of personal information” 前加一个合适的谓语动词,或者按照原文逻辑“ 个人信息数量是众多的” ,译为“The amount of personal information is numerous” 。
例13 :
原文:有学者认为,个人信息数量众多,其边界过于模糊,
译文:Some scholars believe that a large number of personal information, its boundary is too vague,
例14 中,最后一部分缺少谓语动词,漏译了动词“ 出现” ,另外出现谓语成分使用不当现象,将原文“ 判别时间/ 较长” 译作“ 判别花费了很长的时间” ,改变了结构与语义,没有准确传达原文意义,在理解上给读者带来障碍。
例14 :
原文:传统依靠固定规则的网络入侵检测方法,面对不断增大的数据维度和复杂的网络行为,出现大量误判警告或判别时间较长;
译文:The traditional network intrusion detection method that relies on fixed rules faces the increasing data dimensions and complex network behaviors, and a large number of misjudgment warnings or discriminations take a long time.
例15 中,译文为:“ 网络用户或者网络服务提供者利用网络公开个人隐私和其他个人信息比如基因信息、病历资料、健康检查资料、犯罪记录、家庭住址、私人活动,等,自然人,因此造成” 。在伴有很多列举的情况下,机器翻译不易理解其中逻辑关系,造成在对后续的谓语动词及句子翻译时存在一定的问题。
例15 :
原文:“ 网络用户或者网络服务提供者利用网络公开自然人基因信息、病历资料、健康检查资料、犯罪记录、家庭住址、私人活动等个人隐私和其他个人信息,造成他人损害,
译文: "an Internet user or Internet service provider may use the Internet to disclose personal privacy and other personal information such as genetic information, medical records, criminal records, home addresses, private activities, etc., of a natural person, thereby causing.
3 .词序或用词不当导致歧义
例16 中,译文在翻译时“currently” 位置错误,译文为:“currently in practical use” 应改为“in practical use currently” ,译文不符合语法规则,但是读者能够加上认知补充对原文进行理解。
例16 :
原文:镁合金是目前实际应用的最轻的金属结构材料,
译文:Magnesium alloy is the lightest metal structural material currently in practical use.
例17 中,译文在翻译过程中用词不当,将“ 判定” 译作“the principle” 、“ 侵权” 译作“infringement” ,用词不当将会导致歧义,或影响理解,导致意义的传达不准确。
例17 :
原文: 个人信息的侵权判定原则上要进行利益衡量。
译文: the principle of personal information infringement should be weighed in principle.
例18 中,原文“ 此处采取的是…… 规定” ,在译文中被处理为“ 此处定义为” ,用词不当以至于意义被改变,背离原文,造成译文的不忠实,同时将会影响读者理解。
例18 :
原文: 此处采取的是 “ 定义 + 列举式” 规定, 即法律保护隐私信息和个人信息。
译文: The definition here is “Definition + Enumeration”, which means that the law protects private and personal information.
4 .断句、语序错误,一句话两个意群
例19 中,译文意义为:“ 而后者会损害个体的学习能力。认知能力及加深与年龄有关的学习损害。” 原句一整句话被以逻辑混乱的方式断成两句话,且没有逻辑,破坏了原句的逻辑关系,,原句完整的一句话变成两个意群,造成翻译出错。
例19 :
原文:而后者会损害个体的认知能力并加深与年龄有关的学习损害。
译文:while the latter impairs the individual's ability to learn. Cognitive ability and increased age-related learning impairment.
例20 中,原文中“ 更好的神经可塑性” 、“更低的焦虑水平” 本为并列关系,而在此例句翻译中,却将“ 更低的焦虑水平” 单独成句,断句错误造成意义与前文割裂。
例20 :
原文:与对照组相比前者有更好的神经可塑性及更低的焦虑水平
译文:and have better neuroplasticity compared with the control group. And lower levels of anxiety
5. 增译、漏译
例21 中,译文出现增译现象,原文中不存在的内容而出现在译文中,译文增译“ability to learn” 突然增加的内容易破坏原文结构与意义,从而导致翻译的错误。
例21 :
原文:而后者会损害个体的认知能力并加深与年龄有关的学习损害。
译文:while the latter impairs the individual's ability to learn. Cognitive ability and increased age-related learning impairment.
例22 中,译文漏译“ 行为禁区” ,漏译内容相对较少,但是出现漏译信息的现象便会导致意义的不完整,从而影响对译文的理解。
例22 :
原文: “ 信息刑案解释” 除了第1 条 和第 13 条外, 其他 11 个 条 文 都 是 关于定罪、量刑的具体规定, 都是在为他人划定清晰的 “ 行为禁区” 。
译文: “Interpretation of Information Criminal Cases” In addition to Articles 1 and 13, the other 11 provisions are specific provisions on conviction and sentencing, all of which are clearly defined for others.
(三)、可理解的译文
可理解的句子是指没有重大的连贯问题,但存在某些可以忽略的语法问题,尽管存在一些翻译瑕疵,却并不影响读者对原文意义的理解。
1. 术语翻译有瑕疵
术语翻译结果存在一定瑕疵,但是不影响对句子语义的理解,加之读者对术语的理解推测,仍可以对整句意义进行把握。例:“ 网络空间安全” 译为:“cyberspace security” 或“network space security” ,术语“ 应用流程” 译为:“Application process” 或“application flow” ,术语“ 密码学” 译为:”cryptology” 或“cryptography” 。
2. 名词限定结构处理不当
例23 中,原文名词限定结构“镁合金大型铸件的精 密低压铸造成型工艺” 被译作“precision low pressure casting molding process of magnesium alloy large castings” (即:镁合金大型铸件的精密/ 低/ 压/ 铸/ 造成型/ 工艺),翻译时将这一限定结构进行直译,罗列堆砌单个字词的意义,翻译处理不当,出现瑕疵。
例23:
原文:丁文江等将涂层转移制芯技术、坩埚液体金属密封技术与低压铸造技术相结合,开发了镁合金大型铸件的精密低压铸造成型工艺。
译文:Ding Wenjiang and others developed precision low pressure casting molding process of magnesium alloy large castings by combining coating transfer core-making technology, liquid metal seal crucible technology and low pressure casting technology.
3. 句子衔接不明,但不影响文意
例24中,原文句子衔接逻辑为:“ 保证…… 生产技术” ,而在翻译过程中进行了一定改动,译为:“ 生产技术保证…… 生产” 。
例24:
原文:实现两台镁合金低压铸造设备在不同工位之间的切换,保证镁合金铸件生产连续 进行的镁合金低压铸造连续化生产技术。
译文:the switch between the two magnesium alloy low-pressure casting equipment in different working positions can be realized. The continuous production technology of magnesium alloy low pressure casting to ensure the continuous production of magnesium alloy castings.
4. 漏译部分非重要信息
例25中,译文漏译部分非重要信息,多为修饰成分。该译文漏译:“ 组织细小的” ,尽管出现这一漏译现象,但是缺失部分非重要的修饰成分并不影响主要意义的传达与理解。
例25:
原文:而触变压铸则是将预制的组织细小的半固态锭料重新加热到半固态区间进行压铸的成形工艺。
译文:while thixodiecasting is a process in which prefabricated semisolid ingots are reheated to the semisolid interval for die casting.
5. 用词不当
例26 的译文中用词不当,原文“ 电脑中毒” ,被译作“computer poisoning” ,此“ 中毒(poisoning )” 非彼“ 中毒(infecting )” ,正确译法为:“infecting computers” 。尽管这一错误给人错愕之感,但是对读者意义理解的影响较小。
例26 :
原文:2017 年5月,勒索病毒软件利用系统漏洞进行攻击,造成全球多个国家数十万用户电脑中毒;
译文:In May 2017, ransomware software exploited system vulnerabilities to attack, causing computer poisoning of hundreds of thousands of users in many countries around the world;
例27 中,原文中“ 质量” 一词译为“ 重量” ,而译文却处理为“quality” 。“quality” 只能用于品质好坏,不能用于表重量。一定程度上造成理解困扰,但是读者在前后文语境下,大致能理解原文之意义,尽管个别词汇出现翻译偏差,却不影响对整句意义理解。
例27 :
原文:当前也已经具备研发并小批量试制质量达100 kg 镁合金铸件的能力。
译文:At present, it has the ability of developing and producing magnesium alloy castings with quality up to 100 kg in small batch.
(四)、准确译文
准确译文的判定主要从用词、语法的角度来衡量,即在译文中除了保证逻辑、术语准确外,没有在语法、用词搭配等层面的硬性错误。
例28 中,译文可理解,但是在代词和贴切度上有待提高。两个句子中间用which 衔接比较生硬,更好地解决方法可以翻译为“both of which” 。
例28 :
原文:中国两大主体税种是企业所得税和增值税,它们均是共享税。
译文:The two main types of taxes in China are corporate income tax and value-added tax, which are all shared taxes.
例29 中,译文1 中的“greater” 与“less” 使用不当,“larger” 和“smaller” 更吻合上下文,此外译文1 中从句的主语过长,不太吻合英语表达习惯,译文2 相比而言更加接近学术类语篇特点。
例29 :
原文:不同地方在于,本文删去关键变量大于99.5% 分位数和小于0.05% 分位数的观测值,
译文1 :The difference is that the observed values of key variables greater than 99.5% and less than 0.05% are deleted.
译文2 :but the difference is that this paper deletes the observation values of key variables larger than 99.5% and smaller than 0.05%.
例30 中, participate in 一般指有生命的个体或群体参与了某项活动中,但此句中主语本身是一种行为或过程,词汇选择上存在问题,在意思上存在细微差别。此处用“is involved in” 更为准确。
例30 :
原文:自噬是一种进化上保守的细胞内的降解行为,参与了很多生理和病理过程。
译文:Autophagy is an evolutionarily conserved intracellular degradation behavior that participates in many physiological and pathological processes.
例31 的译文中,use 的使用不太贴切。
例31 :
原文:直到20 世纪90 年代,Yoshinori Ohsumi 利用酵母遗传学的手段鉴定了多种自噬相关基因(ATG) ,如ATG1 和ATG13 ,
译文:It was not until the 1990s that Yoshinori Ohsumi used yeast genetics to identify a variety of autophagy-related genes (ATG), such as ATG1 and ATG 13, that the development of autophagy regulation was initiated
(五)、精确译文
精确的译文主要从贴切度的角度来衡量,是指译文在文体、风格上吻合该领域语言的特征。
如例32 的译文虽然满足了意义交流的需要,但是在学术论文中,应尽量规避人称代词和主观意见态度的词汇出现,argues 、we 等词汇的使用都有待改进。
例32 :
原文:本文认为,要研究转移支付对税收努力的作用机制,必须分别考察一般性转移支付、生产性专项转移支付、民生性专项转移支付的作用机制,并且要将政府的支出偏向纳入理论和经验分析中。
译文:This paper argues that in order to study the mechanism of transfer payment on tax efforts, we must examine the mechanism of general transfer payment, productive special transfer payment and livelihood special transfer payment respectively, and put the government expenditure bias into theoretical and empirical analysis.
结束语
本文提出了机器翻译译文质量人工测评的三个维度:可理解度、准确度和贴切度。在此基础之上,进一步将机器翻译译文质量评估切分为精确、准确、可理解、部分可理解和不可理解五个层级。此外,论文还结合学术类语篇的实际测评结果对机器翻译的主要错误类型进行了质化分析。
[基金项目]:本文为国家社科基金项目“ICT 环境下的计算机辅助口译学习系统研究” (项目编号:13BYY042 )和北京语言大学梧桐创新平台资助课题(中央高校基本科研业务费专项基金)(项目编号:16PT02 )的部分研究成果。
参考文献
[1]. Delisle, J. (1993). La traduction raisonnée: Manuel d’initiation à la traduction professionnelle de l’anglais vers le français. Ottawa: Presses de l’Université d’Ottawa.
[2]. Nida, E. A. (1964). Toward a science of translating with special reference to principles and procedures involved in Bible translating. Leiden: E. J. Brill.
[3]. Toury, G. (1995). Deive translation studies and beyond. Amsterdam and Philadelphia: John Benjamins.
[4]. 吕雅娟. 2012. CWMT 机器翻译评测回顾与展望,第八届全国机器翻译研 讨会(CWMT 2012 ),西安理工大学 .
[5]. 许明. 2011. 论语篇衔接与语篇连贯对翻译过程的规范作用. 译苑新谭. 2011 , pp.41-51.
作者简介:许明,博士,硕士研究生导师。研究领域集中在翻译学、认知心理学和语言学的跨学科研究,研究方向包括口笔译认知过程研究、术语学、语篇理解与知识构建、机器翻译译文质量评估等。
联系方式:xuming.china@gmail.com
本文节选自许明等著(2020),《计算机辅助口译学习系统研究》,pp.59-73,转载须注明出处。 返回搜狐,查看更多