AI翻译服务通过硬件、软件连接千千万万个应用场景,会打破语言不通的尴尬局面吗?会是人工翻译的终结者吗?

世界这么大,我想去看看!十一长假临近,梦想中的你背起行囊,自由行走在异国的大街小巷。然而现实的画风很有可能是这样的:走出国门没几天,你就发现期待已久的旅行,因为看不懂听不懂,而身在囧途。此时的你捶胸顿足地感慨道:世界上最遥远的距离,不是天涯海角,是你站在我面前,我却不知道你在说什么。

9月21日,百度智能翻译机在日本发布。名古屋有哪些好玩的景点?怎么乘车最便捷?翻译机流畅精准的中日互译令人惊叹不已。AI翻译服务通过硬件、软件连接千千万万个应用场景,将会打破语言不通的尴尬局面。甚至有人认为,AI翻译是人工翻译的终结者。现实真的如此吗?

现状:产品虽多,准确率有待提高

2017年可谓是AI大行其道的一年,作为现代科技的流行趋势,不管是谷歌、苹果,还是百度、阿里,都在相继发布自己的人工智能产品,向智能行业进军。而AI翻译,几乎是所有互联网巨头都想涉足的领域。

机器翻译已出现了70年,但过去一年里涌现出的AI翻译软硬件产品,已超过最近30年的总和。

在国外,微软发布了翻译工具Microsoft Translator,可以实现9种语言实时语音转为文本翻译。国内的互联网巨头也不甘示弱。百度技术委员会联席主席、自然语言处理部技术负责人吴华表示,百度翻译支持全球28种语言互译、756个翻译方向,每日响应过亿次的翻译请求。除百度外,科大讯飞也走在语音交互前列,推出了讯飞听见升级版产品,加入多语种翻译功能,五种语言同步翻译成汉语,还发布了智能翻译产品“晓译翻译机”。就连网络游戏开发大户腾讯公司,也悄然上线了一款实时语音翻译APP“翻译君”,这款以AI内核驱动的翻译产品,运用了语音识别+NMT(神经网络机器翻译)等技术,可以实现“同声传译”功能,对着屏幕说话时,边说边翻,就像身边带了一位私人翻译官。此外,电商大咖京东也开始涉足AI翻译,推出了一个可以进行多国语言实时翻译的人工智能翻译机——准儿翻译机的众筹项目,目前已经有5008名支持者,轻松筹得320万元的项目基金。

尽管AI翻译进步神速,却不被传统的翻译行业所看好。传神语联网络科技股份有限公司董事长何恩培表示:“无论是翻译机还是APP,中文翻译成英文或其他语种时准确率还可以,但外国人说英文或其他语言时,翻译成中文的准确率就很低,在实际交流时几乎没法用。”

今年2月,谷歌全新NMT系统在韩国世宗大学与人类译员进行的翻译对战就是一例佐证。在规定的50分钟内,人类和机器同时翻译两段随机文本。结果,人类以巨大优势战胜了机器。赛后,评委表示,NMT系统翻译出的文本90%都有语法问题。

难点:数据有限,且语言规则不规律

全球范围内,服务于各大跨国会议、发布会等的30多种翻译机能帮人们解决一些场景中语言交流的问题,但目前的现状就如科大讯飞声明的那样:虽然机器翻译已经取得非常大的进步,但距离高水平翻译所讲究的“信、达、雅”还存在很大差距。

以“千山鸟飞绝,万径人踪灭”这句人们耳熟能详的诗为例,国际翻译界最高奖项之一“北极光”杰出文学翻译奖得主许渊冲教授将其译为“from hill to hill no bird in flight,from path to path no man in sight.”这不仅符合近代著名翻译家严复提出的“信、达、雅”翻译原则,而且其中的意境与精髓只有熟习汉语的人才能领会。

“文学艺术翻译要体现情感、色彩、语调、温度、韵致、字里行间的意味等种种幽微之处。要传达出这些,译者的水准、敏感、境界和心灵力量尤为重要。”中国社会科学院外国文学研究所编审高兴说。

缘何能称霸棋坛的人工智能AlphaGo,却在翻译领域不尽完美?何恩培告诉记者:“机器翻译一直被公认为人工智能领域最难的课题之一。而且语言和围棋不同,语言背后的多元文化和复杂社会属性,注定了语言规则不可能规律化。”“文学作品,以及有引申含义或逻辑关系复杂的句子,AI翻译很难搞定,因为翻译它们不仅是基于理解,而且要使某种意义上待翻译的语言和目标语言对齐。”华为诺亚方舟实验室资深研究员、自然语言处理专家吕正东说。

此外,AI翻译要想达到“信、达、雅”的高度,还需克服口语化的两大难题。一方面要听得清,能准确判断出指令发出者的语音、停顿,并在极短时间内进行“语音断句”。另一方面要克服口语交谈中的语法问题,以及句子不连贯、没有明确句子边界等问题。

机器靠什么解决上述问题?在清华大学计算机系副研究员刘洋看来,AI机器翻译的难点其实也是整个人工智能的难点——如何让机器真正像人一样有智能行为。他认为,机器翻译采用数据驱动的方法,其准确程度取决于给计算机提供哪些数据。目前提供最多的翻译数据来自于政府文档,比如联合国有多种官方语言,基本每份文件都有多语种版本,但基本没有体育、娱乐等领域的数据。再加上各国的口语中都存在较多随意性口语或网络用语,生活化气息浓厚,多为非正式的语体材料,因此智能翻译需要庞大的基础词汇库支撑。“其实所有上述问题,理论上来说都可以靠更多的数据来弥补,但是我们数据是有限的。” 吕正东说。

展望:前路漫漫,发展需数据推动

近两年,神经网络机器翻译(Neural Machine Translation, NMT)技术异军突起使翻译应用进一步革新。

NMT模仿人脑的神经思考模式,产出媲美人工翻译的高质量译文,并将误差降低了55%—85%。目前,谷歌公司己将该技术应用于网页翻译与手机应用,译文质量明显提升。此外,腾讯、百度、阿里巴巴等国内互联网公司也将深度学习理念应用到机器翻译。同时,语言处理、语音交互等技术的进步又加速了翻译产品的场景升级,促使机器辅助翻译”(CAT,Computer Aided Translation)过渡到“人工智能交互翻译”(AI Interactive Translation)。

http://www.cmdmingling.com/post/659.html

AI翻译离无障碍交流有多远的更多相关文章

  1. 含神经网络的离线AI翻译 APP

    功能特性 下载 https://www.microsoft.com/en-us/store/p/translator/9wzdncrfj3pg

  2. C++对象间通信组件,让C++对象“无障碍交流”

    介绍 这是很久之前的一个项目了,最近刚好有些时间,就来总结一下吧! 推荐初步熟悉项目后阅读本文: https://gitee.com/smalldyy/easy-msg-cpp 从何而来 这要从我从事 ...

  3. 为什么AI的翻译水平还远不能和人类相比?

    为什么AI的翻译水平还远不能和人类相比? https://mp.weixin.qq.com/s/0koIt-qu9IOVxNhbFcZr1Q 作者 | SHARON ZHOU 译者 | 王天宇 编辑 ...

  4. 马云谈AI:未来10-15年传统制造业的痛苦将远超今天的想象

    马云谈AI:未来10-15年传统制造业的痛苦将远超今天的想象 “未来10到15年,传统制造业面临的痛苦将会远远超过今天的想象,企业如果不能从规模化.标准化向个性化和智慧化转型,将很难生存下去.” 9月 ...

  5. AI历史和哲学基础浅谈

    换个角度看AI:研究历史和哲学逻辑 正如题图所示,仿生人会梦见电子羊吗?(注:Do Androids Dream of Electric Sheep?是Philip K. Dick所著的一本科幻小说, ...

  6. HMS Core Discovery第16期回顾|与虎墩一起,玩转AI新“声”态

    HMS Core 在AI领域最新的技术能力有哪些?本期Discovery直播以<与虎墩一起,玩转AI新"声"态>为主题,邀请了HMS Core 机器学习服务产品经理.机 ...

  7. 译文 对无障碍网页应用(ARIA)的选择

    //本文编辑格式为Markdown,译文同时发布在众成翻译 对无障碍网页应用(ARIA)的选择 让网站对每个人都能访问是一件相当艰难的工作,尤其是在我们使用自定义标记解决方案(custom marku ...

  8. 2018 AI产业界大盘点

    2018  AI产业界大盘点 大事件盘点 “ 1.24——Facebook人工智能部门负责人Yann LeCun宣布卸任 Facebook人工智能研究部门(FAIR)的负责人Yann LeCun宣布卸 ...

  9. [人工智能]IBM Watson人工智能API|一步步创建智能微信翻译官|第一章

    最近参加了IBM可认知内部创业活动,想从零创建一个微信翻译工具,这就是我的AI翻译官.

随机推荐

  1. vue+element搭建的后台管理系统

    最近工作不是很忙,自己在学习vue,在网上找了一个简单的项目练练手..... 这是本人的gitHub 上的项目地址:https://github.com/shixiaoyanyan/vue-admin ...

  2. SimpleRpc-系统边界以及整体架构

    系统边界 什么是系统边界?系统边界就是在系统设计之初,对系统所要实现的功能进行界定,不乱添加,不多添加.这么做的好处就是,系统简单明了,主旨明确,方便开发和用户使用.举个例子,一个自动售货机的本职工作 ...

  3. Spring连接池的常用配置

    1.连接池概述 数据库连接是一种关键的有限的昂贵的资源,这一点在多用户的网页应用程序中体现得尤为突出.对数据库连接的管理能显著影响到整个 应用程序的伸缩性和健壮性,影响到程序的性能指标.数据库连接池正 ...

  4. day09<面向对象+>

    面向对象(多态的概述及其代码体现) 面向对象(多态中的成员访问特点之成员变量) 面向对象(多态中的成员访问特点之成员方法) 面向对象(多态中的成员访问特点之静态成员方法) 面向对象(超人的故事) 面向 ...

  5. AngularJS–service(服务)

    点击查看AngularJS系列目录 转载请注明出处:http://www.cnblogs.com/leosx/ 服务 Angular的服务也是使用依赖注入(dependency injection ( ...

  6. snsapi_base和snsapi_userinfo

    1.以snsapi_base为scope发起的网页授权,是用来获取进入页面的用户的openid的,并且是静默授权并自动跳转到回调页的.用户感知的就是直接进入了回调页(往往是业务页面) 2.以snsap ...

  7. NOIP2017SummerTraining0713

    个人感受:这套题是真的难,以至于,拿了130分就第三了(说来羞耻,真的不想---) 问题 A: 乐曲创作 时间限制: 1 Sec  内存限制: 256 MB提交: 370  解决: 58[提交][状态 ...

  8. Windows中的硬链接和软链接(hard link 和 Symbolic link)

    先来了解一下Linux中的硬链接和软链接: Linux中的硬链接和软链接 Windows中的硬链接和软链接: 硬链接 从Windows NT4开始,NTFS文件系统引入了HardLink这个概念,它让 ...

  9. 委托、事件、Observer观察者模式的使用解析一

    一.前言 委托.事件得理论我就不解释了,不会的时候觉得很难,会了发现挺简单的,回头想想其实在JavaScript中常常用到,譬如:setTimeout()就是典型的委托. 二.传统编码方式 传统的调用 ...

  10. Response.Write输出导致页面变形和页面白屏解决办法

    方法一:此方法应该是微软官方推荐的方法,但弹出时会造成页面白屏.Page.RegisterStartupScript("TestEvent", "<script&g ...