HDFS源码(一)

Hadoop RPC框架原理

RPC(Remote Procedure Call,远程过程调用)是一种通过网络从远程计算机程序上请求服务而不需要了解底层网络技术的协议,通过RPC 能让应用层可以像调用本地方法一样调用远程方法。Hadoop中各个节点之间的通信就是通过RPC 进行通信。

RPC 采用Client/Server模式,请求程序就是Client客户端,服务提供程序就是Server服务端。客户端首先发送带参数的调用请求到服务器,然后等待服务器的响应,在服务器端,一旦有调用请求到达,服务提供程序会执行请求,计算结果,并向客户端发送响应信息,然后等待下一个调用请求,最终,客户端成功接收服务器发回的响应信息,一次远程调用完成。

Rpc工作原理图如下:

Client Function:客户端请求程序,可以像调用本地方法一样调用 Client Stub程序,也能接受Stub程序的响应信息。

Client Stub:客户端Stub程序,当客户端调用时会通过通信模块将信息发送给服务器,同时会等待服务器的响应信息。

socket:网络通信模块,用于传输RPC请求和响应。

Server Stub:服务端Stub程序,会接收客户端发送的请求和参数,根据响应信息触发对应的服务程序,然后将结果返回给客户端。

Server Function:服务端服务程序,会接受服务端Stub程序的调用请求并执行对应的逻辑返回结果。

HadoopRPC实现方式类似上图,代码位于hadoop-common中的org.apache.hadoop.ipc包下,HadoopRPC由3个类组成:RPC、Client和Server,这里不再深入查看相关源码,这里我们通过简单的例子来模拟RPC客户端和服务端通信。

定义接口协议(Protocol)及实现

RPC通信中有Client和Server端,由于在客户端可以像调用本地方法一样调用远程服务端方法并能解析做出响应,我们可以把这些方法抽象到一个接口中形成统一的接口协议。即:接口协议是一种"结构层次的协议",通过定义一组接口和方法来规范客户端和服务端之间的通信,我们可以把接口和接口中的方法称为协议,客户端和服务端只要实现这些接口中的方法就可以进行通信。如下图示:

创建并启动Server服务

定义类创建并启动RPC Server服务:

java 复制代码
/**
 * RPC Server
 */
public class RpcServer {

    public static void main(String[] args) throws IOException {
        //创建 RPC 框架
        RPC.Builder builder = new RPC.Builder(new Configuration());

        //绑定地址
        builder.setBindAddress("localhost");

        //绑定端口
        builder.setPort(8888);

        //绑定协议
        builder.setProtocol(RpcProtocol.class);

        //调用协议实现类
        builder.setInstance(new RpcProtocolImpl());

        //创建RPC Server 服务
        RPC.Server server = builder.build();

        //启动RPC Server 服务
        server.start();

        System.out.println("服务端启动成功~");
    }
}

创建Client服务调用远程服务

NameNode启动源码

启动NameNode HttpServer

加载fsimage和editslog

创建NameNode RpcServer并启动

检测集群是否处于安全模式

相关推荐
大大大大晴天6 小时前
Hudi技术内幕:RecordPayload到RecordMerger
大数据
SelectDB21 小时前
秒级弹性、最高降本 70%:SelectDB Serverless 如何重塑云数仓资源效率
大数据·后端·云原生
WhoAmI21 小时前
MapReduce框架原理解析一:InputFormat
大数据·hadoop
WhoAmI21 小时前
MapReduce框架原理解析三:OutputFormat
大数据·hadoop
WhoAmI21 小时前
MapReduce框架原理解析二:Shuffle
大数据·hadoop
大大大大晴天2 天前
Hudi技术内幕:Key Generation原理与实践
大数据
得物技术5 天前
从埋点需求到规则资产:Hermes Agent 重构得物数仓工作流
大数据·llm·ai编程
久美子5 天前
AI驱动数仓建设的Harness工程实践——本体建模、知识分层与上下文工程
大数据
大树886 天前
金刚石散热越强,管路越先见顶
大数据·运维·服务器·人工智能·ai
大志哥1236 天前
ES和Logstash日志链路系统上线后遭遇切片爆炸(解决)
大数据·elasticsearch