本平台为商业科创服务平台 非政府政务服务网站

基于大数据的蒙汉神经机器翻译研究

更新时间:2026-10-01
基于大数据的蒙汉神经机器翻译研究 科技成果来源:呼和浩特科技成果库;
地区:内蒙古-呼和浩特;
成果名称:基于大数据的蒙汉神经机器翻译研究
完成单位:呼和浩特民族学院
完成人:包乌格德勒、赵小兵、斯日古楞、李娟
成果登记号:9152022J0153
成果登记日期:2022-08-09
成果登记号:9152022J0153
成果简介:该成果是2017年度内蒙古自治区蒙古语言文字信息化专项扶持重点项目“融合大数据与多语言开放域的蒙汉文知识图谱构建及其应用技术共享服务平台”(MW-2017-MGYWXXH-04)的主要成果,该项目由呼和浩特民族学院、中央民族大学联合承担,项目资金为300万元。该项目的研究内容包括: 1.融合大数据与多语言开放域的蒙汉文大规模平行文本、知识图谱构建与标注技术研究 2.基于大数据的机器翻译智能技术 3.蒙汉智能应用共享服务平台的搭建 该项目的一个研究目标是研究基于深度学习的蒙汉文机器翻译模型,搭建语言学研究者及领域知识智能检索和智能机器翻译社会应用的共享平台,探索知识与技术的开放共享服务机制。 成果主要贡献: 1.搭建了蒙古语到汉语的在线机器翻译平台。 机器翻译是利用计算机技术将一种自然语言转换为另一种自然语言的过程,是人工智能的终极目标之一。蒙汉机器翻译研究对内蒙古自治区和蒙古族的发展均具有重要实践意义和应用价值,也是发扬和传承蒙古族悠久历史和优秀文化重要手段。该平台实现了从蒙古语到汉语的机器翻译,促进了蒙汉机器翻译技术的发展。 2.蒙汉平行语料句对丰富。 该平台在130万蒙汉句对语料基础上完成翻译模型,语料领域包括政治、法律、新闻、文学、影视、网络用语、日常用语等,并对所有语料进行了校对、去重等处理。 3.支持传统蒙古文的Unicode编码和蒙科立编码。 该平台支持传统蒙古文的两种编码类型:蒙科立(旧)编码和Unicode编码。由于蒙古文国际标准编码(Unicode)出台的相对滞后,早期很多蒙古文网站和语料都采用了蒙科立(旧)编码,这部分语料的翻译不需要先进行编码转换,可在平台直接进行翻译。 4.支持蒙古文的自动校对。 由于蒙古文自身的语法特点,存在着大量的形同音不同的词和音同形不同的词,用户需要掌握较高的蒙古语语法知识才能准确录入蒙古文。但是目前很多人还不能完全掌握这些语法知识,录入的蒙古文文本中存在大量的错误。该平台支持蒙古文的自动校对,对用户输入的蒙古文文本自动进行校对后翻译。
以上信息来自国家科技成果公共数据库,科技成果所有人非我平台所有。如信息有误请联系我方更正!
电话咨询
到底部
搜本页
回顶部
搜索
搜本页
欢迎咨询

扫码可加微信,手机访问拨打咨询

欢迎咨询

欢迎咨询
数据加载中...