编者按:这是微软亚洲研究院和中国科学院共同进行的一个合作项目,希望通过使用Kinect来帮助提升手语的识别率,从而为听力受损的残障人士(以下简称听障人士)架起一座与外界沟通的桥梁。

文章译自:Digital
Assistance for Sign-Language Users

对于听障人士来说,手语是他们与外界沟通最主要的语言。然而,不是每个人都懂得手语,即使是人工手语翻译也是可遇不可求。通过计算机来识别手语,然后进行翻译,听上去是一个很好的想法,但这个想法到今天为止却还未真正得以实现。正因如此,近些年来研究人员花费了大量时间攻克手语识别领域所存在挑战。他们曾研究过诸如数据手套或特殊摄像头这样的输入传感器潜在的发展空间。虽然前者在识别方面表现很好,但因为难以穿戴和过于昂贵很难投入广泛使用。而网络摄像头或立体摄像头虽然能够保证追踪手部运动的精度和速度,却很难处理好复杂背景和光照。

然后,一种叫做Kinect的设备进入人们视野。微软亚洲研究院的研究员与中国科学院计算技术研究所的同僚展开合作,对Kinect的肢体追踪功能如何应用于手语识别进行了研究。结果让人欣慰!这项技术让以手语为主要沟通手段的听障人士像使用语音识别一样,与电脑进行更为自然和流畅的互动。

“在我们看来,这个项目最显著的贡献是它向我们展示了通过3-D和2-D传感器构建手语识别的可能。”中国科学院陈熙霖教授表示。

微软研究院学术合作部的帮助和支持下,这项成果被总结成为论文《基于Kinect的手语识别和翻译》,联合作者为中国科学院柴秀娟、李广、陈熙霖等研究员,以及微软亚洲研究院首席研究员周明

正因为Kinect能够同时提供深度信息和色彩数据,它让准确、快速追踪手部和肢体动作变得更加容易。

近日,微软研究院第14届教育高峰会(Faculty
Summit 2013
)在微软总部举行,其中的展示环节Demo
Fest
与超过400名学术研究者们分享了具有深远影响力的研究,其中就包括该手语识别项目。这是一个3-D运动轨迹校准并将手语和单词逐一对应的过程。当一个手语词汇被分析时,这些词语先通过Kinect
for Windows SDK
的手部动作轨迹生成,然后规范化,继而计算匹配分数,最后识别出最相关的候选。

反过来,3-D轨迹匹配的算法又为构建一个手语识别和翻译的系统创建了基础。这一系统包括两个模式。第一是翻译模式,将手语翻译成文本或者语音,包括对单词或单句的识别。第二是交流模式,通过使用虚拟形象使正常人和听障人士的沟通变成可能。以键盘输入的文本为引导,虚拟形象可以表现出相应的手语。而听障人士通过手语进行回应,系统会将其转换为文本进行回答。

Kinect手语识别项目真实场景演示片段

这样有效吗?出乎意料地有效!

“这个项目一个独特的贡献是联合了计算机研究员和听障人士的共同努力,”周明说,“一群来自特殊学院的教师和学生加入了这个项目,使得我们的算法数据来源于真实的世界”。

这刚好与项目的目标相契合。该研究在视觉信息处理领域颇具价值,与此同时,也为那些极需此类援助的人群提供了帮助。

“自从Kinect问世以来,我们已经不止一次惊喜地看到它被研究人员进行‘再创造’”,微软研究院学术合作部,负责自然用户界面相关学术研究合作的主管Stewart
Tansley
表示,“该项目是学术界与微软研究院紧密合作的一个范例,也证明了科技的潜力——跨越语言和文化的界限,潜移默化地改善我们的生活,最终让我们彼此之间联系得更为紧密。”

这项研究在视觉信息处理领域具有巨大的价值,同时它也旨在为那些主要依赖手语进行交流的人们提供实际援助。

“我们相信IT应该被用来提升所有人的日常生活质量,”微软亚洲研究院研究项目经理吴国斌说,“希望这项成果在不久的将来能够为听障人士提供一个日常互动工具,在他们和拥有正常听力的人之间架起一座桥梁。”

微软教育高峰会对Kinect手语识别项目进行访谈
____________________________________________________________________________

相关阅读:

Kinect for Windows带着创新与机遇登陆中国

Kinect掀起外科手术的革命

创新改变生活

欢迎关注

微软亚洲研究院官方微博:http://e.weibo.com/msra/profile

微软亚洲研究院人人主页:http://www.renren.com/600674137

用Kinect为听障人士架一座沟通的桥梁的更多相关文章

  1. 探索Kinect的更多可能——亲历第十九届机器人世界杯RoboCup

    作者:微软亚洲研究院资深项目经理 吴国斌 2015年7月19日,第十九届RoboCup机器人世界杯足球赛,在中国合肥隆重开幕.来自全球七十六个国家和地区的一百余支代表队参加了决赛,他们优秀的作品给观众 ...

  2. “冰桶挑战”之外:微软科技助力ALS患者

    编者按:"直到ALS出现治疗方法,科技就是我的解药."ALS患者,前美国橄榄球联盟(NFL)球员Steve Gleason如是说.最近,一支微软首届黑客马拉松(Hackathon) ...

  3. 雅虎UED--无障碍网页设计

    转自:http://www.sharetk.com/html/ued/Interactive-Design/1394.html 随着web使用量的增加和人们网络意识的增强,一些特殊用户开始被我们所关注 ...

  4. HTML入门3

    HTML主要工作在于编辑文本结构和文本内容,也称语义(semantics)以便能够再浏览器正确地显示,下面开始介绍在文本中添加标题,段落,强调语句,创建列表等等 基础:标题和段落 内容结构化会使得阅读 ...

  5. Python猫荐书系列之七:Python入门书籍有哪些?

    本文原创并首发于公众号[Python猫],未经授权,请勿转载. 原文地址:https://mp.weixin.qq.com/s/ArN-6mLPzPT8Zoq0Na_tsg 最近,猫哥的 Python ...

  6. Insights直播回顾——手语服务,助力沟通无障碍

    HMS Core Insights第九期直播–手语服务,助力沟通无障碍,已于12月29日圆满结束,本期直播与小伙伴们一同了解了HMS Core手语服务的亮点特性.底层技术以及演进规划,下面我们一起来回 ...

  7. HMS Core新闻行业解决方案:让技术加上人文的温度

    开发者们,你希望用户如何获取新闻? 有的人靠手机弹窗知天下事,有的人则在新闻应用中尽览每一篇文章:有的人一目十行,有的人则喜欢细细咀嚼:有的人主动探索,有的人则想要应用投其所好. 科技在不断刷新着用户 ...

  8. 华为HMS Core携手超图为三维GIS注入新动能

    6月30日,在2022(第五届)GIS软件技术大会GIS基础软件新技术板块论坛上,华为联合超图推出了基于HMS Core 3D Engine开发的高保真三维GIS插件,通过3D渲染技术助力三维GIS实 ...

  9. 【毕业设计】基于Android的家校互动平台开发(内含完整代码和所有文档)——爱吖校推(你关注的,我们才推)

    ☆ 写在前面 之前答应大家的毕业答辩之后把所有文档贡献出来,现在答辩已过,LZ信守承诺,把所有文档开源到了GitHub(这个地址包含所有的代码和文档以及PPT,外层为简单的代码).还望喜欢的朋友们,不 ...

随机推荐

  1. 在VS中编写Qt5涉及到的一点字符串问题

    在VS中开发Qt5程序似乎成了我的一种习惯,因为觉得VS简直不能再溜了,不愧是"宇宙第一IDE". 所以在开发中难免会遇到中文显示乱码的问题,网上找到的很多方法都是类似于下面这样的 ...

  2. ES6 之 函数的扩展 尾调用以及尾递归

    函数参数的默认值 function log(x, y) { y = y || 'world' console.log(x + ' ' + y); } log('hello') // hello wor ...

  3. .net core excel导入导出

    做的上一个项目用的是vs2013,传统的 Mvc模式开发的,excel报表的导入导出都是那几段代码,已经习惯了. 导入:string filename = ExcelFileUpload.FileNa ...

  4. 代码杂谈-or符号

    看到别人的代码里用了 or, 有点巧用. 记录一下. def func(a,b, context=None): # .... ctx = context or global_context() # . ...

  5. B - Common Divisors (codeforces)数论算法基本定理,唯一分解定理模板

    You are given an array aa consisting of nn integers. Your task is to say the number of such positive ...

  6. 201771010123汪慧和《面向对象程序设计JAVA》第六周实验总结

    一.理论部分: 1.继承 用已有类来构建新类的一种机制.当定义了一个新类继承了一个类时,这个新类就继承了这个类的方法和域,同时在新类中添加新的方法和域以适应新的情况. 2.类.超类.子类 (1)类继承 ...

  7. 题解【[BJOI2012]算不出的等式】

    题目背景emmm \[\text{首先特判掉p=q时的情况(ans = }p^2-1\text{)}\] \[\text{构造函数}f(k) = \left\lfloor \frac{kq}{p}\r ...

  8. 给锚点a标签添加滑动效果

    a标签是前端必用之一,但是a标签点击后马上跳到了href属性值处,有时候要达到滑动效果就要自己添加JavaScript 普通的a标签代码写好之后,在js脚本内加上 $("a").c ...

  9. Oracle与MySQL的区别对比

    本文对数据库Oracle与MySQL进行了区别对比,其中从并发性.一致性.事务.数据持久性等十三方面进行了对比. 本文摘自 51cto 一.并发性 并发性是oltp数据库最重要的特性,但并发涉及到资源 ...

  10. jsp动作标签学习

    <jsp:useBean> <jsp:useBean>标签用于在指定的域范围内查找指定名称的JavaBean对象,如果存在则直接返回该JavaBean对象的引用,如果不存在则实 ...