腾讯数据安全专家谈联邦学习开源项目FATE:通往隐私保护理想未来的桥梁
数据孤岛、数据隐私以及数据安全,是目前人工智能和云计算在大规模产业化应用过程中绕不开的“三座大山”。
“联邦学习”作为新一代的人工智能算法,能在数据不出本地的情况下,实现共同建模,提升AI模型的效果,从而保证数据隐私安全,突破数据孤岛和小数据的限制,这无疑成为了跨越“三座大山”的途径之一。因此,作为联邦学习全球首个工业级开源项目,FATE也受到了各方关注,开发者们对加入社区建设纷纷表示期待。(FATE开源社区地址:https://github.com/FederatedAI/FATE)
而在贡献者激励机制推出以后,FATE开源社区迎来了首位一级贡献者——来自腾讯云的刘洋。联邦学习怎样赋能行业数据安全?隐私保护从业者怎样评价FATE?刘洋博士在采访中表达了自己的看法。

数据运算提效70% 加速企业应用落地
博士毕业于澳大利亚国立大学的刘洋,同时是腾讯云的高级研究员,负责腾讯神盾沙箱的隐私保护算法部分。刘洋表示,因自身从业领域的缘故,从年初就开始密切关注着“联邦学习”。
也因此,FATE进入了其视野,受到了刘洋及腾讯云团队的重点关注。在对FATE进行深入了解后,刘洋认为腾讯神盾沙箱打造的隐私安全+分布式学习的理念,与FATE要解决的“数据安全”“数据隐私”“数据合规”三大问题不谋而合,并逐步开始使用FATE满足神盾沙箱的功能需求。

刘洋表示,经过长期接触后,对FATE的逻辑回归和XGBoost算法流十分认同,因此也开始加入FATE开源社区建设,提出了优化建议——利用对称的仿射密码替代Paillier密码,将训练时间提升70%以上,从而给同态运算“减负”。未来合作企业在应用优化过后的FATE版本时,可以有效降低数据运算的时间成本,提升企业在AI时代的技术竞争能力。
行业负重前行 数据安全迫在眉睫
AI应用场景中,将多方数据中心式合并处理的传统合作方式,存在着严重的隐私泄露问题,这一症结甚至成为了企业大规模应用AI的关键阻碍。
在刘洋看来,破局关键仍在于数据安全问题的解决,即数据privacy和utility的折衷问题。具体来说,数据要想安全的从孤岛分享出去,必须经历某些“蒙面”操作:通过密码学工具将有效数据转换成乱码,privacy保住了,但密钥在谁手中,极大的影响数据的utility;用噪声混淆原始数据也可以,例如差分隐私,噪声越大,越保证privacy,但使用者拿到数据发挥的utility越低。怎样在privacy和utility中寻求一条折衷之路,是数据安全流通的关键问题之一。
未来理想的状态是,任何数据使用者能够在自由流动和聚合的分布式数据之上,进行高效的数据挖掘操作,而丝毫感觉不到隐私保护的羁绊。在MPC(Multi-party Computation,多方安全计算)领域,目前行业还停留在混淆电路、可信计算等解决方案,虽然支持的计算任务具有一般性,但需要额外的硬件支持,学习成本较高,阻碍了规模化应用的同时,也不利于安全数据联盟的形成。
而联邦学习在具有普适性的联邦框架中,针对每一种或每一类机器学习算法进行订制化的隐私保护改造,使它们的使用无异于经典的中心式机器学习模型。相比之下,联邦学习在稳住成本的基础上,确保了易用性。刘洋称,对于企业而言,联邦学习提供的解决方案更具吸引力;对于行业而言,更便捷的操作将吸引更多开发人员的投入,从而推进安全数据联盟的构建。
FATE生态×腾讯云 数据安全未来可期
今年5月初起,FATE和腾讯云神盾沙箱就开始进行业务往来和技术交流,目前神盾沙箱的核心计算模块由FATE提供。在搭建平台过程中,双方紧密合作。刘洋在采访中表示,团队在使用FATE框架、算法时,会将有效建议贡献到FATE开源项目中,参与开源社区建设。

这种带有“互助互惠,开源共筑”特色的合作形式,在促进了神盾沙箱的产品打磨和FATE项目的完善的同时,也给其他技术项目或团队提供了很好的样板示范——以开放的姿态拥抱新的技术,不仅于自身有利,也将助推整个行业的发展。
在刘洋的设想中,未来两者可以在提升技术影响力和业务落地等方面进行更深层次的协作,例如合作发表重要论文、提交专利和联手接手内外部实际业务,形成“学术”“业界”两开花的美好局面。
随着越来越多贡献者加入FATE理论标准与行业应用的建设,FATE势必会迎来更广阔的前景。对此,刘洋表示,神盾沙箱和FATE的联手将会加速数据安全的扎根与生长,在数据孤岛之上构建起安全数据联盟的未来可期。
腾讯数据安全专家谈联邦学习开源项目FATE:通往隐私保护理想未来的桥梁的更多相关文章
- 联邦学习开源框架FATE助力腾讯神盾沙箱,携手打造数据安全合作生态
近日,微众银行联邦学习FATE开源社区迎来了两位新贡献者——来自腾讯的刘洋及秦姝琦,作为云计算安全领域的专家,两位为FATE构造了新的功能点,并在Github上提交修复了相关漏洞.(Github项目地 ...
- 转: 学习开源项目的若干建议(infoq)
转: http://www.infoq.com/cn/news/2014/04/learn-open-source 学习开源项目的若干建议 作者 崔康 发布于 2014年4月11日 | 注意:GTLC ...
- 华为章宇:如何学习开源项目及Ceph的浅析
转自http://www.csdn.net/article/2014-04-10/2819247-how-to-learn-opensouce-project-&-ceph 摘要:开源技术的学 ...
- MindSpore联邦学习框架解决行业级难题
内容来源:华为开发者大会2021 HMS Core 6 AI技术论坛,主题演讲<MindSpore联邦学习框架解决隐私合规下的数据孤岛问题>. 演讲嘉宾:华为MindSpore联邦学习工程 ...
- 开源项目live555学习心得
推荐:伊朗美女找丈夫比找工作难女人婚前一定要看清三件事 × 登录注册 疯狂少男-IT技术的博客 http://blog.sina.com.cn/crazyboyzhaolei [订阅][手机订 ...
- 转:开源项目学习方法ABC
文章来自于 http://yizhaolingyan.net/?p=123#comment-207 学习各种开源项目,已经成为很多朋友不可回避的工作内容了.笔者本人也是如此.在接触并学习了若干个开源项 ...
- Github上关于iOS的各种开源项目集合2(强烈建议大家收藏,查看,总有一款你需要)
资源list:Github上关于大数据的开源项目.论文等合集 Awesome Big Data A curated list of awesome big data frameworks, resou ...
- 不想加班开发管理后台了,试试这个 Java 开源项目吧!
本文适合有 Java 基础并了解 SpringBoot 框架的同学 本文作者:HelloGitHub-嘉文 这里是 HelloGitHub 推出的<讲解开源项目>系列,今天给大家带来一款开 ...
- Apache Pulsar 在腾讯 Angel PowerFL 联邦学习平台上的实践
腾讯 Angel PowerFL 联邦学习平台 联邦学习作为新一代人工智能基础技术,通过解决数据隐私与数据孤岛问题,重塑金融.医疗.城市安防等领域. 腾讯 Angel PowerFL 联邦学习平台构建 ...
随机推荐
- cmake 在mac系统的安装
CMake是一个比make更高级的跨平台的安装.编译.配置工具,可以用简单的语句来描述所有平台的安装(编译过程).并根据不同平台.不同的编译器,生成相应的Makefile或者project文件.本文主 ...
- 转 - JS 中 call 和 apply 以及 bind 的区别
转自 https://blog.csdn.net/wyyandyou_6/article/details/81488103
- 华为模拟器eNSP基本命令
华为模拟器eNSP常用命令 本文转自:https://blog.csdn.net/Key_book/article/details/80542264 路由器命令行常用命令: 1. system-vie ...
- zping ping包工具20180605.exe测试版
链接: https://pan.baidu.com/s/1WB3BZn0r9n4DRU_8bNC65g 提取码: mybi zping的第一个exe版本由于未对兼容性进行测试,使用python3.6编 ...
- C语言Ⅰ博客作业09
这个作业属于那个课程 C语言程序设计II 这个作业要求在哪里 https://edu.cnblogs.com/campus/zswxy/CST2019-3/homework/10029 我在这个课程的 ...
- [bzoj2746][HEOI2012]旅行问题 _AC自动机_倍增
[HEOI2012]旅行问题 题目链接:https://www.lydsy.com/JudgeOnline/problem.php?id=2746 题解: 这个是讲课时候的题. 讲课的时候都在想怎么后 ...
- CSS:盒子的定位与浮动
CSS--盒子定位.浮动与居中 HTML中的每个元素都是一个盒子 浏览器对HTML文档进行解析,根据盒子的属性对其进行排列. 每个元素默认使用标准文档流定位 标准文档流:是指浏览器读取HTML ...
- poj 3320 复习一下尺取法
尺取法(two point)的思想不难,简单来说就是以下三步: 1.对r point在满足题意的情况下不断向右延伸 2.对l point前移一步 3. 回到1 two point 对连续区间的问题求 ...
- WebClient小结
webclient功能有限,特别是不能使用身份验证证书,这样,上传数据时候问题出现,现在许多站点都不会接受没有身份验证的上传文件.尽管可以给请求添加标题信息并检查相应中的标题信息,但这仅限于一般意义的 ...
- O056、Extend Volume 操作
参考https://www.cnblogs.com/CloudMan6/p/5645305.html 今天学习如何扩大volume的容量,为了保护现有的数据,cinder不允许缩小volume. ...