腾讯数据安全专家谈联邦学习开源项目FATE:通往隐私保护理想未来的桥梁
数据孤岛、数据隐私以及数据安全,是目前人工智能和云计算在大规模产业化应用过程中绕不开的“三座大山”。
“联邦学习”作为新一代的人工智能算法,能在数据不出本地的情况下,实现共同建模,提升AI模型的效果,从而保证数据隐私安全,突破数据孤岛和小数据的限制,这无疑成为了跨越“三座大山”的途径之一。因此,作为联邦学习全球首个工业级开源项目,FATE也受到了各方关注,开发者们对加入社区建设纷纷表示期待。(FATE开源社区地址:https://github.com/FederatedAI/FATE)
而在贡献者激励机制推出以后,FATE开源社区迎来了首位一级贡献者——来自腾讯云的刘洋。联邦学习怎样赋能行业数据安全?隐私保护从业者怎样评价FATE?刘洋博士在采访中表达了自己的看法。
数据运算提效70% 加速企业应用落地
博士毕业于澳大利亚国立大学的刘洋,同时是腾讯云的高级研究员,负责腾讯神盾沙箱的隐私保护算法部分。刘洋表示,因自身从业领域的缘故,从年初就开始密切关注着“联邦学习”。
也因此,FATE进入了其视野,受到了刘洋及腾讯云团队的重点关注。在对FATE进行深入了解后,刘洋认为腾讯神盾沙箱打造的隐私安全+分布式学习的理念,与FATE要解决的“数据安全”“数据隐私”“数据合规”三大问题不谋而合,并逐步开始使用FATE满足神盾沙箱的功能需求。
刘洋表示,经过长期接触后,对FATE的逻辑回归和XGBoost算法流十分认同,因此也开始加入FATE开源社区建设,提出了优化建议——利用对称的仿射密码替代Paillier密码,将训练时间提升70%以上,从而给同态运算“减负”。未来合作企业在应用优化过后的FATE版本时,可以有效降低数据运算的时间成本,提升企业在AI时代的技术竞争能力。
行业负重前行 数据安全迫在眉睫
AI应用场景中,将多方数据中心式合并处理的传统合作方式,存在着严重的隐私泄露问题,这一症结甚至成为了企业大规模应用AI的关键阻碍。
在刘洋看来,破局关键仍在于数据安全问题的解决,即数据privacy和utility的折衷问题。具体来说,数据要想安全的从孤岛分享出去,必须经历某些“蒙面”操作:通过密码学工具将有效数据转换成乱码,privacy保住了,但密钥在谁手中,极大的影响数据的utility;用噪声混淆原始数据也可以,例如差分隐私,噪声越大,越保证privacy,但使用者拿到数据发挥的utility越低。怎样在privacy和utility中寻求一条折衷之路,是数据安全流通的关键问题之一。
未来理想的状态是,任何数据使用者能够在自由流动和聚合的分布式数据之上,进行高效的数据挖掘操作,而丝毫感觉不到隐私保护的羁绊。在MPC(Multi-party Computation,多方安全计算)领域,目前行业还停留在混淆电路、可信计算等解决方案,虽然支持的计算任务具有一般性,但需要额外的硬件支持,学习成本较高,阻碍了规模化应用的同时,也不利于安全数据联盟的形成。
而联邦学习在具有普适性的联邦框架中,针对每一种或每一类机器学习算法进行订制化的隐私保护改造,使它们的使用无异于经典的中心式机器学习模型。相比之下,联邦学习在稳住成本的基础上,确保了易用性。刘洋称,对于企业而言,联邦学习提供的解决方案更具吸引力;对于行业而言,更便捷的操作将吸引更多开发人员的投入,从而推进安全数据联盟的构建。
FATE生态×腾讯云 数据安全未来可期
今年5月初起,FATE和腾讯云神盾沙箱就开始进行业务往来和技术交流,目前神盾沙箱的核心计算模块由FATE提供。在搭建平台过程中,双方紧密合作。刘洋在采访中表示,团队在使用FATE框架、算法时,会将有效建议贡献到FATE开源项目中,参与开源社区建设。
这种带有“互助互惠,开源共筑”特色的合作形式,在促进了神盾沙箱的产品打磨和FATE项目的完善的同时,也给其他技术项目或团队提供了很好的样板示范——以开放的姿态拥抱新的技术,不仅于自身有利,也将助推整个行业的发展。
在刘洋的设想中,未来两者可以在提升技术影响力和业务落地等方面进行更深层次的协作,例如合作发表重要论文、提交专利和联手接手内外部实际业务,形成“学术”“业界”两开花的美好局面。
随着越来越多贡献者加入FATE理论标准与行业应用的建设,FATE势必会迎来更广阔的前景。对此,刘洋表示,神盾沙箱和FATE的联手将会加速数据安全的扎根与生长,在数据孤岛之上构建起安全数据联盟的未来可期。
腾讯数据安全专家谈联邦学习开源项目FATE:通往隐私保护理想未来的桥梁的更多相关文章
- 联邦学习开源框架FATE助力腾讯神盾沙箱,携手打造数据安全合作生态
近日,微众银行联邦学习FATE开源社区迎来了两位新贡献者——来自腾讯的刘洋及秦姝琦,作为云计算安全领域的专家,两位为FATE构造了新的功能点,并在Github上提交修复了相关漏洞.(Github项目地 ...
- 转: 学习开源项目的若干建议(infoq)
转: http://www.infoq.com/cn/news/2014/04/learn-open-source 学习开源项目的若干建议 作者 崔康 发布于 2014年4月11日 | 注意:GTLC ...
- 华为章宇:如何学习开源项目及Ceph的浅析
转自http://www.csdn.net/article/2014-04-10/2819247-how-to-learn-opensouce-project-&-ceph 摘要:开源技术的学 ...
- MindSpore联邦学习框架解决行业级难题
内容来源:华为开发者大会2021 HMS Core 6 AI技术论坛,主题演讲<MindSpore联邦学习框架解决隐私合规下的数据孤岛问题>. 演讲嘉宾:华为MindSpore联邦学习工程 ...
- 开源项目live555学习心得
推荐:伊朗美女找丈夫比找工作难女人婚前一定要看清三件事 × 登录注册 疯狂少男-IT技术的博客 http://blog.sina.com.cn/crazyboyzhaolei [订阅][手机订 ...
- 转:开源项目学习方法ABC
文章来自于 http://yizhaolingyan.net/?p=123#comment-207 学习各种开源项目,已经成为很多朋友不可回避的工作内容了.笔者本人也是如此.在接触并学习了若干个开源项 ...
- Github上关于iOS的各种开源项目集合2(强烈建议大家收藏,查看,总有一款你需要)
资源list:Github上关于大数据的开源项目.论文等合集 Awesome Big Data A curated list of awesome big data frameworks, resou ...
- 不想加班开发管理后台了,试试这个 Java 开源项目吧!
本文适合有 Java 基础并了解 SpringBoot 框架的同学 本文作者:HelloGitHub-嘉文 这里是 HelloGitHub 推出的<讲解开源项目>系列,今天给大家带来一款开 ...
- Apache Pulsar 在腾讯 Angel PowerFL 联邦学习平台上的实践
腾讯 Angel PowerFL 联邦学习平台 联邦学习作为新一代人工智能基础技术,通过解决数据隐私与数据孤岛问题,重塑金融.医疗.城市安防等领域. 腾讯 Angel PowerFL 联邦学习平台构建 ...
随机推荐
- RocketMQ之八:重试队列,死信队列,消息轨迹
问题思考 死信队列的应用场景? 死信队列中的数据是如何产生的? 如何查看死信队列中的数据? 死信队列的读写权限? 死信队列如何消费? 重试队列和死信队列的配置 消息轨迹 1.应用场景 一般应用在当正常 ...
- main.js中的Vue.config.productionTip = false
开发模式:npm run dev是前端自己开发用的生产模式:npm run build 打包之后给后端放在服务端上用的Vue.config.productionTip = false1上面这行代码的意 ...
- iptables基本命令到深入
1.关闭firewalld,安装iptables-server并启动服务 systemctl stop firewalld systemctl disable firewalld yun -y ins ...
- C++学习笔记-STL
C++ STL (Standard Template Library标准模板库) 是通用类模板和算法的集合,它提供给程序员一些标准的数据结构的实现如 queues(队列), lists(链表), 和 ...
- C学习笔记-字符串
对于C语言来说,字符串其实就是最后一个元素为'\0'的char数组 字符数组的初始化 字符数组常见的有两种初始化方式 char str[] = "hello"; 或者 char s ...
- Excel输入公式后只显示公式却不计算如何解决?
在使用Excel函数公式的时候,您是否碰到过输入公式,按下Enter键之后,单元格仍只显示公式,而不显示计算结果. 工具/原料 Excel 教程以Excel2013为例 方法/步骤 教 ...
- Java利用模板生成pdf并导出
1.准备工作 (1)Adobe Acrobat pro软件:用来制作导出模板 (2)itext的jar包 2.开始制作pdf模板 (1)先用word做出模板界面 (2)文件另存为pdf格式文件 (3) ...
- java集合List解析
作为一个Developer,Java集合类是我们在工作中运用最多的.最频繁的类.相比于数组(Array)来说,集合类的长度可变,更加适合于现代开发需求: Java集合就像一个容器,可以存储任何类型的数 ...
- 【LOJ】#3085. 「GXOI / GZOI2019」特技飞行
LOJ#3085. 「GXOI / GZOI2019」特技飞行 这显然是两道题,求\(C\)是一个曼哈顿转切比雪夫后的线段树扫描线 求\(AB\),对向交换最大化和擦身而过最大化一定分别为最大值和最小 ...
- centerOS7安装lnmp环境
视频地址: https://www.bilibili.com/video/av55251610?p=65 安装nginx http://nginx.org 点击 download vim /etc/y ...