火星链 火星链
Ctrl+D收藏火星链
首页 > Fil > 正文

TEP:科普:联邦学习的分类和应用场景

作者:

时间:1900/1/1 0:00:00

前言

上一篇我们讲述了人工智能,机器学习与联邦学习的关系。

这篇我们将继续探索联邦学习方法的分类。联邦学习方法被分为横向联邦学习、纵向联邦学习和迁移联邦学习三类,适用于解决不同的实际问题。

横向联邦学习

在两个数据集的用户特征重叠较多而用户重叠较少的情况下,把数据集按照用户维度切分,并取出双方用户特征相同而用户不完全相同的那部分数据进行训练。这种方法叫做横向联邦学习。

▲?应用场景

徐明星新书《趣说金融史》正式发布 科普金融发展之道:金色财经现场报道,9月23日,欧科云链创始人徐明星携手著名财经作家李霁月、行业观察者顾泽辉力作《趣说金融史》一书,跨越5000年金融历史,重读金钱故事,并预测新的金融时代。该书由中信出版社出版,将于近期正式发售。据了解,本书可以更好地呈现金融的起源与发展,帮助人们理解货币、金融与未来经济。作为区块链行业领军企业——欧科云链的创始人,徐明星深知技术探索对经济社会的重要推动作用,他曾先后出版过《图说区块链》、《区块链:重塑经济与世界》、《通证经济》、《链与未来》等行业权威著作,解读区块链等新型技术的推动下,金融与社会的升级之道,对经济社会发展做出了重大贡献。其中,《区块链:重塑经济与世界》曾作为新中国70周年重点推荐图书之一被相关书店推荐。[2021/9/23 17:00:57]

横向联邦学习的本质是样本的联合,适用于参与者间业态相同但触达客户不同,即特征重叠多,用户重叠少时的场景,比如不同地区的银行间,他们的业务相似,但用户不同。

国务院:推进科普与区块链技术深度融合:为贯彻落实党中央、国务院关于科普和科学素质建设的重要部署,依据《中华人民共和国科学技术进步法》、《中华人民共和国科学技术普及法》制定《全民科学素质行动规划纲要(2021-2035年)》,其中要求实施智慧科普建设工程。推进科普与区块链等技术深度融合,强化需求感知、用户分层、情景应用理念,推动传播方式、组织动员、运营服务等创新升级,加强“科普中国”建设,强化科普信息落地应用,与智慧教育、智慧城市、智慧社区等深度融合。(新华社)[2021/7/10 0:40:52]

比如,有两家不同地区银行?—?上海与杭州两地的两家银行,它们的用户群体分别来自上海与杭州的居住人口,用户的交集相对较小。由于银行间的业务相似,记录的用户特征大概率是相同的。因此,横向联邦学习可以被考虑用来构建联合模型。

于2017年,Google提出了一个针对安卓手机模型更新的数据联合建模方案:在单个用户使用安卓手机时,不断在本地更新模型参数并将参数上传到安卓云上,从而使特征维度相同的各数据拥有方建立联合模型的一种联邦学习方案。

IMF今日发布的加密货币科普视频实为两年前旧闻,且存在诸多疏漏:国际货币基金组织IMF今日在推特上发布了一条关于加密货币的科普视频,这段时长两分钟的视频最初发布于2018年6月。该视频称加密货币是“货币进化的下一步”,但没有特别提到DLT、区块链,甚至是代币名称等术语。BTC、XRP和ETH只出现在说明加密交易的图形中。尽管这段视频到目前为止已经获得了超过13.7万的点击量和2900个赞,但来自加密社区的许多反应都是批评的,他们指出了信息中的漏洞和似乎具有误导性的措辞。

Reddit用户nanooverbtc称:“他们犯了很多错误,比如把私钥称为密码。”该视频也没有讨论挖矿或加密货币供应。Kraken策略师Pierre Rochard等知名人士表示:“可证明的稀缺性是比特币有趣的原因,你忘了提这一点。”(Cointelegraph)[2020/8/24]

▲?学习过程

动态 | 新浪财经:官媒针对区块链的报道从科普宣传转向打假监管:据新浪财经今日消息,“1025新政”满月,一个月间,官媒对区块链的态度风向已转。据11月初的一项统计,七家党媒在新政一周内发布了65篇直接相关报道,当时文章中的关键词是数据、产业、安全、创新等,大量文章偏向于科普区块链的概念以及应用介绍,提醒警惕虚拟货币炒作的仅有3篇。近期,官媒的批评焦点则纷纷指向借区块链之名进行的虚拟货币发行和炒作行为。据统计,新华网、人民网收录转载的,以打击虚拟货币或揭露假借区块链行为主题的文章,自10月25日到11月25日午间,共28篇;其中,11月19日至11月25日的一周内就高达15篇。这些文章主要围绕三个观点展开:厘清区块链和虚拟货币的关系,说明二者概念不等;打击伪“区块链”局,或是虚拟货币局揭露;提醒民众,区块链不能成为炒作的噱头,更不是行的招牌,需警惕此类活动,理性投资。[2019/11/26]

财政部副部长朱光耀:数字经济还处在发展的过程中,要以科普、推动的态度来推进数字经济发展:今日,在中国发展高层论坛2018年会上,财政部副部长朱光耀表示:“数字经济还处在发展的过程中,要以科普、推动的态度来推进数字经济发展。也要关注数字经济的其他影响,包括税收征管、反监管措施等要跟上。”[2018/3/25]

Step1.参与方各自从协调方上下载最新模型;

Step2.每个参与方利用本地数据训练模型,加密梯度上传给协调方,协调方聚合各用户的梯度以更新模型参数;

Step3.协调方返回更新后的模型给各参与方;

Step4.各参与方更新各自模型。

纵向联邦学习

在两个数据集的用户重叠较多而用户特征重叠较少的情况下,把数据集按照特征维度切分,并取出双方用户相同而用户特征不完全相同的那部分数据进行训练。这种方法叫做纵向联邦学习。

▲?适用场景

纵向联邦学习的本质是特征的联合,适用于用户重叠多,特征重叠少的场景,比如同一地区的商超和银行,他们触达的用户都为该地区的居民,但业务不同。

比如,有两个不同机构,一家是某地的银行,另一家是同一个地方的电商。它们的用户群体很有可能包含该地的大部分居民,用户的交集可能较大。由于银行记录的都是用户的收支行为与信用评级,而电商则保有用户的浏览与购买历史,因此它们的用户特征交集较小。纵向联邦学习就是将这些不同特征在加密的状态下加以聚合,以增强模型能力的联邦学习。

▲?学习过程

介绍一种简单通用的纵向联邦学习的建模学习过程,加密方式也以半同态加密的PallierEncryption为主。

训练前:

先采用加密文本对齐的技术手段,在系统内筛选出不同企业之间的共同用户。

训练时:

Step1.协调方C向企业A与B发送公钥,用来加密所需传输的数据;

Step2.A和B分别计算和自己相关特征的中间结果,并加密完后进行交互,用来求解各自的梯度结果和损失结果;

Step3.A和B分别计算各自加密后的梯度并添加掩码后发送给C,同时B计算加密后的损失先发送给C;

Step4.C解密梯度和损失后回传给A和B,A、B去除掩码并更新模型。

迁移联邦学习

在两个数据集的用户与用户特征重叠都较少的情况下,不对数据进行切分,而可以利用迁移学习来克服数据或标签不足的情况。这种方法叫做联邦迁移学习。

▲?适用场景

当参与者间特征和样本重叠都很少时可以考虑使用联邦迁移学习,如不同地区的银行和商超间的联合。主要适用于以深度神经网络为基模型的场景。

迁移学习的核心是,找到源领域和目标领域之间的相似性。举一个杨强教授经常举的例子来说明:我们都知道在开车时,驾驶员坐在左边,靠马路右侧行驶。这是基本的规则。然而,如果在英国、香港等地区开车,驾驶员是坐在右边,需要靠马路左侧行驶。那么,如果我们从到了香港,应该如何快速地适应他们的开车方式呢?诀窍就是找到这里的不变量:不论在哪个地区,驾驶员都是紧靠马路中间。这就是我们这个开车问题中的不变量。找到相似性?(不变量),是进行迁移学习的核心。

比如有两个不同机构,一家是位于中国的银行,另一家是位于美国的电商。由于受到地域限制,这两家机构的用户群体交集很小。同时,由于机构类型的不同,二者的数据特征也只有小部分重合。在这种情况下,要想进行有效的联邦学习,就必须引入迁移学习,来解决单边数据规模小和标签样本少的问题,从而提升模型的效果。

▲?学习过程

联邦迁移学习的步骤与纵向联邦学习相似,只是中间传递结果不同。

以上是常见的几种联邦学习类型,联邦学习这件“小事”能用在什么场景中,带来怎样的价值,会在下一篇文章中详细介绍。也欢迎各位与我们一起对以上三种类型的联邦学习进行更深一步的讨论,添加小助手加入技术交流群。

作者简介

严杨

来自数据网格实验室BitXMesh团队?PirvAIの修道者

标签:区块链STESTEPTEP有人靠区块链4天就挣了30万块钱Stealthcoinstepn币总量SuperStep

Fil热门资讯
AVA:Avalanche创始人:看好加密市场长期前景,但短期内或保持横盘走势

据Cointelegraph7月6日消息,Avalanche创始人EminGünSirer表示,目前加密货币价格的下跌并没有减弱他对市场未来的总体热情.

1900/1/1 0:00:00
LIB:苏黎世CoinGeek会议:比特币的价值来自比特币作为促进支付、记录数据和账本协议的本质

巴比特讯,7月10日,在苏黎世CoinGeek会议上,比特币协会创始主席JimmyNguyen主持了一场关于“比特币和加密资产——真正的价值从何而来?”的小组讨论.

1900/1/1 0:00:00
DOG:碎片化NFT交易平台Unicly将在SushiSwap上推出碎片NFT拍卖

据Cryptopotato消息,碎片化NFT交易平台Unicly将在SushiSwap的IDO发行平台MISO上推出碎片化NFT拍卖,此举使得uToken可以获得更优的价格发现.

1900/1/1 0:00:00
USDC:以太坊伦敦升级已确定所有纳入的EIP,共包括EIP-1559等5个EIP

以太坊开发者TimBeiko发文概述以太坊伦敦升级。虽然目前还未确定各网络的升级区块,但已最终确定纳入的所有EIP.

1900/1/1 0:00:00
COI:加密情报公司:参议员Chuck Grassley引用的加密犯罪数据“存在严重缺陷”

据Coindesk7月16日报道,据多家加密情报公司称,美国参议员ChuckGrassley正在使用有关非法比特币活动的“存在严重缺陷”的估计数据来呼吁对该行业进行更严格的审查.

1900/1/1 0:00:00
以太坊:巴比特每日精选:Burberry首个NFT系列将于8月11日推向市场;Louis Vuitton推出NFT 系列收藏品抽奖活动;以太坊伦敦硬分叉升级即将落地,通缩会来吗?

提要:近日,时尚圈的奢侈品牌Burberry、LouisVuitton纷纷推出了NFT相关产品,NFT的狂热,也许只是刚刚开始.

1900/1/1 0:00:00