HDFS源码(一)

Hadoop RPC框架原理

RPC(Remote Procedure Call,远程过程调用)是一种通过网络从远程计算机程序上请求服务而不需要了解底层网络技术的协议,通过RPC 能让应用层可以像调用本地方法一样调用远程方法。Hadoop中各个节点之间的通信就是通过RPC 进行通信。

RPC 采用Client/Server模式,请求程序就是Client客户端,服务提供程序就是Server服务端。客户端首先发送带参数的调用请求到服务器,然后等待服务器的响应,在服务器端,一旦有调用请求到达,服务提供程序会执行请求,计算结果,并向客户端发送响应信息,然后等待下一个调用请求,最终,客户端成功接收服务器发回的响应信息,一次远程调用完成。

Rpc工作原理图如下:

Client Function:客户端请求程序,可以像调用本地方法一样调用 Client Stub程序,也能接受Stub程序的响应信息。

Client Stub:客户端Stub程序,当客户端调用时会通过通信模块将信息发送给服务器,同时会等待服务器的响应信息。

socket:网络通信模块,用于传输RPC请求和响应。

Server Stub:服务端Stub程序,会接收客户端发送的请求和参数,根据响应信息触发对应的服务程序,然后将结果返回给客户端。

Server Function:服务端服务程序,会接受服务端Stub程序的调用请求并执行对应的逻辑返回结果。

HadoopRPC实现方式类似上图,代码位于hadoop-common中的org.apache.hadoop.ipc包下,HadoopRPC由3个类组成:RPC、Client和Server,这里不再深入查看相关源码,这里我们通过简单的例子来模拟RPC客户端和服务端通信。

定义接口协议(Protocol)及实现

RPC通信中有Client和Server端,由于在客户端可以像调用本地方法一样调用远程服务端方法并能解析做出响应,我们可以把这些方法抽象到一个接口中形成统一的接口协议。即:接口协议是一种"结构层次的协议",通过定义一组接口和方法来规范客户端和服务端之间的通信,我们可以把接口和接口中的方法称为协议,客户端和服务端只要实现这些接口中的方法就可以进行通信。如下图示:

创建并启动Server服务

定义类创建并启动RPC Server服务:

java 复制代码
/**
 * RPC Server
 */
public class RpcServer {

    public static void main(String[] args) throws IOException {
        //创建 RPC 框架
        RPC.Builder builder = new RPC.Builder(new Configuration());

        //绑定地址
        builder.setBindAddress("localhost");

        //绑定端口
        builder.setPort(8888);

        //绑定协议
        builder.setProtocol(RpcProtocol.class);

        //调用协议实现类
        builder.setInstance(new RpcProtocolImpl());

        //创建RPC Server 服务
        RPC.Server server = builder.build();

        //启动RPC Server 服务
        server.start();

        System.out.println("服务端启动成功~");
    }
}

创建Client服务调用远程服务

NameNode启动源码

启动NameNode HttpServer

加载fsimage和editslog

创建NameNode RpcServer并启动

检测集群是否处于安全模式

相关推荐
kisy夏1 小时前
多千帆运营平台
大数据·爬虫·mysql
yyuuuzz7 小时前
独立站的技术基础与常见运维问题
大数据·运维·服务器·网络·数据库·aws
微擎应用11 小时前
智能售货柜公众号管理系统平台
大数据·人工智能
计算机安禾13 小时前
【算法分析与设计】第26篇:参数化算法与固定参数可解性理论
大数据·人工智能·算法·机器学习·剪枝
liushangzaibeijing13 小时前
Superpower 使用大纲
大数据·elasticsearch·搜索引擎
Elastic 中国社区官方博客13 小时前
每次操作一个 API 调用:Elastic Cloud Hosted 如何让大规模部署管理变得可行
大数据·运维·数据库·elasticsearch·搜索引擎·serverless
志栋智能16 小时前
超自动化安全:实现安全运营现代化的关键
大数据·运维·网络·安全·自动化
渣渣盟16 小时前
MySQL DDL操作全解析:从入门到精通,包含索引视图分区表等全操作解析
大数据·数据库·mysql
unclejet17 小时前
颠覆传统开发!AI根治软件工程技术债务顽疾
大数据·人工智能·软件工程
赴山海bi17 小时前
如何在不降低销量的情况下降低亚马逊ACOS
大数据