【机器学习】联邦学习 Federated Learning

有很多用户安装了Google的app,比如搜索引擎等。这些移动端的app都会搜集数据,产生数据。有些数据对于Google来说是有用的,所以Google想要建立一个机器学习模型,然后使用移动端的数据来训练机器学习模型。app把这些数据收集起来,发送到Google云端,然后Google在自己的集群上来训练模型,Google有足够的计算资源,这样不就解决了吗?但是事情不是这么简单的。假如有一个这样的限制,照片是隐私不想让Google传到云端上,那么如何训练机器学习模型呢?

每家医院都有自己的数据,可以用来训练自己的模型将实现预测等,但是每家的数据都不多,训练的效果也不好。最简单的方法就是将数据整合起来,在服务器上将模型进行训练。但是,用户数据不能轻易交给别人。

之前的时候学习过并行算法或者是分布式算,其中有一种编程模型,Parameter Server,我们可以用这种模型训练神经网络, 计算几乎都是Worker做的,Server端存储模型参数或者更新模型参数。

每一轮都要重复这样的操作:Worker向Server索要模型参数,然后Worker作本机计算,求出模型梯度。 Worker将计算出的梯度发送给Server,然后Server用梯度更新模型更新参数。

上述过程中,我们可以知道数据没有离开Worker,这样的话减少clock time的同时还保护了用户的隐私。联邦学习是一种分布式学习,联邦学习跟传统的分布式学习有很多不同:

  • 用户对他们的设备和数据有绝对的控制权
  • Worker节点不稳定
  • 通信代价比计算代价要高
  • 存储在Worker节点中的数据并不是独立同分布的(IID)
  • 节点负载不平衡
相关推荐
阿坡RPA7 小时前
手搓MCP客户端&服务端:从零到实战极速了解MCP是什么?
人工智能·aigc
用户27784491049937 小时前
借助DeepSeek智能生成测试用例:从提示词到Excel表格的全流程实践
人工智能·python
机器之心7 小时前
刚刚,DeepSeek公布推理时Scaling新论文,R2要来了?
人工智能
算AI10 小时前
人工智能+牙科:临床应用中的几个问题
人工智能·算法
凯子坚持 c10 小时前
基于飞桨框架3.0本地DeepSeek-R1蒸馏版部署实战
人工智能·paddlepaddle
你觉得20511 小时前
哈尔滨工业大学DeepSeek公开课:探索大模型原理、技术与应用从GPT到DeepSeek|附视频与讲义下载方法
大数据·人工智能·python·gpt·学习·机器学习·aigc
8K超高清11 小时前
中国8K摄像机:科技赋能文化传承新图景
大数据·人工智能·科技·物联网·智能硬件
hyshhhh11 小时前
【算法岗面试题】深度学习中如何防止过拟合?
网络·人工智能·深度学习·神经网络·算法·计算机视觉
薛定谔的猫-菜鸟程序员11 小时前
零基础玩转深度神经网络大模型:从Hello World到AI炼金术-详解版(含:Conda 全面使用指南)
人工智能·神经网络·dnn
币之互联万物11 小时前
2025 AI智能数字农业研讨会在苏州启幕,科技助农与数据兴业成焦点
人工智能·科技