Hadoop 启动!

​2024/4/22

上个星期我们已经完成了Hadoop的安装及配置文件的修改 下面 我们将namenode进行一下初始化

hdfs namenode -format

(创建文件存储目录:账本目录namenode datanode的目录)

我们在配置时 这就是用来设置账本目录的

我们做完格式化后 tmp目录就出现了

9.Hadoop原理

1)datanode(程序):负责存储

文件被分成block存储在磁盘上 为保证数据安全 文件会有多个副本

在写入数据的时候 自己写一份 顺便给集群中其他地方一份 达到了备份的效果 只是做到了分布式存储 但是并没有将每一块分开的数据进行区分

那么 这个时候 我们要做一个账本

2)namenode(作账本):负责管理 管理文件(a.txt)与block之间的关系 block与datanode之间的关系

3)Secondarynamenode:账本很重要 所以账本需要备份 账本的备份

10.启动Hadoop

启动文件系统:start-dfs.sh stop-dfs.sh

启动计算系统:start-yarn.sh

问题:hadoop中有多少个进程 分别是干嘛的

11.测试

上传数据:hadoop fs -put linux文件路径 hadoop文件路径

查看:hadoop fs -ls /

192.168.38.101:50070

相关推荐
2302_799525745 分钟前
【Hadoop】如何理解MapReduce?
数据库·hadoop·mapreduce
火龙谷1 小时前
hadoop第3课(hdfs shell常用命令)
hadoop·hdfs·npm
神秘打工猴2 小时前
数据仓库为什么要分层
大数据·数据仓库·spark
Hard_pea2 小时前
Spark 深入解析
大数据·分布式·spark
闯闯桑2 小时前
Scala 中的访问修饰符
大数据·开发语言·scala
后端小肥肠2 小时前
解锁DeepSpeek-R1大模型微调:从训练到部署,打造定制化AI会话系统
大数据·人工智能
24k小善11 小时前
flink集成tidb cdc
大数据·flink·tidb
StableAndCalm11 小时前
什么是hive
数据仓库·hive·hadoop
kngines13 小时前
【实战ES】实战 Elasticsearch:快速上手与深度实践-3.2.3 案例:新闻搜索引擎的相关性优化
大数据·elasticsearch·搜索引擎
秦南北13 小时前
国内领先的宠物类电商代运营公司品融电商
大数据·人工智能·电商