首页 | 本学科首页   官方微博 | 高级检索  
相似文献
 共查询到17条相似文献,搜索用时 46 毫秒
1.
机器翻译研究用计算机实现不同自然语言之间的翻译。自第一台计算机诞生开始,人们一直在研究和探索高质量高效率的机器翻译技术。近年来,基于规则的机器翻译、基于实例的机器翻译和基于统计的机器翻译这几种主要的翻译模式共同存在且相互补充,并有不断融合之势。随着中国和日本在科技、经济和文化交流的不断深入,机器翻译研究对于打破汉语和日语之间的语言壁垒进而推进中日两国各个领域的交流与合作具有重要的应用价值。中国和日本两国机器翻译研究人员已经开展了大量的汉日/日汉机器翻译的理论研究与系统研制,已取得了有效的成果,但距离大规模实际应用和高标准的翻译质量的要求尚有差距。为此,中日两国机器翻译人员有必要在汉日/日汉机器翻译技术与系统研制方面展开合作,特别是在对齐平行文本、实例词典、专业术语词典以及句法分析等共同课题方面展开合作。文章介绍了中日两国机器翻译研究的进展并加以比较,对中日两国在机器翻译领域的合作做了分析与展望。  相似文献   

2.
对双语术语抽取技术中的一项重要分支:基于可比语料库的双语术语抽取技术进行了综述分析.当前研究者采用的方法依据是"上下文相似"理论,即两个在源语言共现的词,对应到目标语言中的两个词也将共现.当前技术主要包含候选词的上下文特征的模型构造和上下文特征模型的优化.对已有的研究给出了一个初步的评价标准,分别对两项研究按照方法复杂度层次进行分析总结,指出存在的问题.最后对基于可比语料库的双语术语抽取技术的未来进行了展望.  相似文献   

3.
在甲骨文信息化研究中,基于关键词匹配的检索方式在查全率和查准率两个方面均不理想。领域本体作为共享概率化的明确的形式化规范说明,既可以将检索范围限定在特定领域,也可以通过概念间的关系寻找与关键字相关联的潜在信息,从而有效弥补关键词匹配方式的缺陷。在构建甲骨文文献本体的基础上,建立了一个基于领域本体的甲骨文文献语义检索模型,通过查询分析模块对查询条件进行分析,将检索关键词进行语义扩展,从而得到新的检索条件,再通过检索分析模块与本体库映射进行语义推理,从而提高检索的准确率和查全率。  相似文献   

4.
汉英双语标注集的研究与实现   总被引:1,自引:0,他引:1  
标注集是任何自然语言处理研究中的知识表达基础。本文结合汉英双向机器翻译开发和双语语料库加工的实践,提出了建立标准的汉英双语标注集的必要性,探讨了该标注集设计过程中遇到的几个关键问题并给出了一个比较完备的汉英双语标注集解决方案。实践证明,该方案具有良好的开放性和兼容性,对于汉英双向机器翻译系统和汉英双语语料库研究都具有适用性。  相似文献   

5.
汉英双向机器翻译系统BT863的研究与实现   总被引:3,自引:2,他引:1  
本文将经验主义方法与传统的基于规则的理性主义体系结合起来,提出了一种面向实例、基于模式的机器翻译路线,并在这一翻译路线的指导下,以分析与生成一体、面向生成为基本实现策略,实现了一个面向汉英日常用语的汉英双向机器翻译系统BT863。  相似文献   

6.
刘凯  王永成  毛军 《情报学报》2005,24(3):294-298
本文提出了一种适合机器翻译的标记语言MTML(MachineTranslationMarkupLanguage)。针对机器翻译研究中对混合策略处理的需求,我们将传统的机器翻译方法与模式匹配及XML等技术相结合,形成了一套灵活的、可扩展的处理机制,方便了基于规则的翻译与数据驱动的翻译之间的交互。目前已经将该标记语言应用到翻译试验系统之中,获得了较好的效果  相似文献   

7.
汉英机器翻译中汉语离合词的处理策略   总被引:4,自引:0,他引:4  
汉语中词的离合是指词的构成元素( 两个或多个汉字) 之间的结合不很紧密,可以在其 间插入某些其它成分而被分离,但被分离的词所表达的基本语义不变的语法现象。本文从大规模 语料库中对汉语离合词进行了详细的统计分析,并给出了BT863 汉英机器翻译系统中汉语离合词 的处理策略。  相似文献   

8.
张家俊  宗成庆 《情报工程》2017,3(3):021-028
近两年来,神经机器翻译(Neural Machine Translation, NMT)模型主导了机器翻译的研究,但是统计机器翻译(Statistical Machine Translation, SMT)在很多应用场合(尤其是专业领域)仍有较强的竞争力。如何利用深度学习技术提升现有统计机器翻译的水平成为研究者们关注的主要问题。由于语言模型是统计机器翻译中最核心的模块之一,本文主要从语言模型的角度入手,探索神经网络语言模型在统计机器翻译中的应用。本文分别探讨了基于词和基于短语的神经网络语言模型,在汉语到英语和汉语到日语的翻译实验表明神经网络语言模型能够显著改善统计机器翻译的译文质量。  相似文献   

9.
本文以多语言科技信息服务为立足点,结合中日两国面向科技文献的机器翻译研究现状,介绍了两国近几年开展的机器翻译合作项目的情况,包括合作背景与基础、知识产权、具体合作内容与成果,以及在机器翻译实用化方面的一些思考。  相似文献   

10.
11.
介绍本体作为知识工程领域的一种新方法被引入到汉英机器翻译的研究中,用来协助机器翻译中对自然语言语义的理解和计算;指出本体为源语言与目标语言的词汇提供中性化、形式化的表达,其概念语义网络为自然语言的歧义消除提供世界知识、语义空间,本体工具本身所具有的推理功能也使机器翻译的语义处理更为便捷,本体已逐渐成为语义处理的新的理论基础及工具。  相似文献   

12.
研究分词在统计机器翻译中的影响因素,分析不同分词对机器翻译词对齐模型的影响,提出基于粒度约束和子串标注的分词优化方法,并通过优化分词提高机器翻译的效果。  相似文献   

13.
鉴于专利术语的翻译要求高度的准确性和专业性,而专利术语的自动获取翻译对于机器翻译、词典自动编纂、跨语言信息检索等自然语言处理具有重要的实用价值,从双语的专利摘要中分别抽取术语,之后融合多术语识别方法,采用规则翻译和统计机器翻译来动态地辅助词汇化方法进行术语对齐,以期尽可能多地在双语的专利文献中获取准确的专利术语翻译对。在专利文摘中进行实验验证的结果是:专利术语翻译对的准确率达到80%。  相似文献   

14.
面向专利领域的机器翻译近年来已成为机器翻译的重要应用领域之一。本文提出了一个汉英专利文本机器翻译融合系统,该系统以规则系统为主导搭建,并把规则翻译方法和基于短语的统计翻译系统相结合。在融合系统中,规则系统主要负责源语言的分析和转换阶段的处理,生成相应的源语言句法分析树与转换树,并确定目标语言的基本句法框架。统计翻译系统则在目标语生成阶段根据生成的目标语句法结构寻找合适的对译词形,并产生最终的候选译文。通过利用自动评测指标对融合系统进行测试,融合系统的结果均优于单个规则系统和统计系统的结果,表明了融合方法的有效性和可行性,可以改善系统的翻译性能,提高翻译质量。  相似文献   

15.
针对专利文献句子偏长的特点,将统计机器翻译中的训练语料进行子句切割获取双语的子句序列,再采 用统计和规则相结合的策略来生成子句对齐,建立基于简单子句的双语语料来重新训练统计机器翻译系统,在一定程 度上改善了原有双语训练语料中的短语对齐和词对齐,可以更为深入地利用平行语料中蕴含的翻译信息,应用于专利 统计机器翻译中,在NTCIR-9的测试集上进行实验比较,获得较为满意的翻译效果。  相似文献   

16.
多机器翻译系统融合技术能够对不同机器翻译系统的输出结果有效地进行融合,产生更好的翻译性能,因此该技术成为机器翻译研究领域的一个热点问题。文章介绍了中国科学技术信息研究所(ISTIC)参加第七届全国机器翻译研讨会机器翻译评测的情况。本单位参加了英汉科技领域的机器翻译评测项目。文章阐述了本单位机器翻译系统的实现框架以及实施细节,并分析了它们在评测数据上的性能表现,最后对机器翻译系统融合方法目前的现状进行讨论,并对该系统融合方法进行总结和展望。  相似文献   

17.
周炯亮  周昌乐 《情报学报》2001,20(2):207-211
本文探讨了网上机器翻译的分类、可用性、国际国内的市场应用状况和在中国开发网上机器翻译的紧迫性 ,最后提出了目前存在的主要问题 ,并展望了网上机器翻译的发展新趋势  相似文献   

设为首页 | 免责声明 | 关于勤云 | 加入收藏

Copyright©北京勤云科技发展有限公司  京ICP备09084417号