Sqoop实操案例-互联网招聘数据迁移

🥇🥇【大数据学习记录篇】-持续更新中~🥇🥇


个人主页:beixi@

本文章收录于专栏(点击传送):【大数据学习】
💓💓持续更新中,感谢各位前辈朋友们支持学习~💓💓

上一篇文章写到了Sqoop的安装与验证,这篇文章接着上篇文章延伸Sqoop迁移数据的案例操作,如果Sqoop没有安装成功的小伙伴们可以参考我上一篇文章:大数据组件Sqoop-安装与验证

文章目录

1.环境介绍

本次用到的环境有:
Oracle Linux 7.4
Hadoop 2.7.4
mysql
sqoop

2.启动hadoop环境

1.打开命令窗口,启动HDFS平台。

bash 复制代码
start-all.sh

2.查看master上HDFS守护进程,注意:依据系统不同,实际显示可能与截图有出入,只要红色框中HDFS所示4个进程存在,即是正确

bash 复制代码
jps

3.互联网招聘数据迁移案例

1.进入Linux命令窗口,登录mysql,我这里账号密码都是root

bash 复制代码
mysql -uroot -proot

2.构建源数据库

bash 复制代码
create database job_db character set 'utf8' collate 'utf8_general_ci';

3.查看数据库

bash 复制代码
show databases;

4.使用job_db数据库

bash 复制代码
use job_db;

5.原始job.sql文件存储在/root/experiment/datas/job/job.sql,将原始数据导入mysql,构建原始表数据

bash 复制代码
source /root/experiment/datas/job/job.sql

6.查看导入结果

bash 复制代码
show tables;

7.查看表数据

bash 复制代码
select * from position;

8.退出mysql窗口

bash 复制代码
quit;

9. 进入sqoop根目录

bash 复制代码
cd /opt/sqoop

10.使用命令列出主机所有数据库

bash 复制代码
bin/sqoop list-databases --connect jdbc:mysql://localhost:3306/ --username root --password root 

11.用命令列出job_db数据库中所有的数据表

bash 复制代码
bin/sqoop list-tables --connect jdbc:mysql://localhost:3306/job_db --username root --password root

12.使用命令将数据库中的表导入到HDFS指定目录中

bash 复制代码
bin/sqoop import  --connect jdbc:mysql://localhost:3306/job_db --username root --password root --delete-target-dir --table position  --target-dir /sqoop/position --m 1 


13.查看/sqoop目录下的文件

bash 复制代码
hdfs dfs -ls -R /sqoop

14.查看导入到HDFS的文件内容

bash 复制代码
hdfs dfs -cat /sqoop/position/part-m-00000


15.再次将数据库中的表数据导入HDFS中,此次采用Tab制表格将字段进行分割

bash 复制代码
bin/sqoop import  --connect jdbc:mysql://localhost:3306/job_db --username root --password root --delete-target-dir --table position  --target-dir /sqoop/position2 --m 1 --fields-terminated-by '\t' 


16.查看HDFS中sqoop目录下的内容

bash 复制代码
hdfs dfs -ls -R /sqoop

17.查看导入到HDFS的文件内容

bash 复制代码
hdfs dfs -cat /sqoop/position2/part-m-00000



至此,互联网招聘数据迁移案例实验到到此结束,如果本篇文章对你有帮助记得点赞收藏+关注~

相关推荐
暮云星影2 分钟前
一、linux系统 应用开发:基本认知概念
linux·arm开发
座山雕~9 分钟前
docker---部署与常用命令
运维·docker·容器
赵民勇18 分钟前
yum命令用法与技巧总结
linux·centos
凯丨26 分钟前
使用 frp 实现内网穿透:让本地服务器安全暴露到公网
运维·服务器·安全
小小福仔29 分钟前
Linux运维基础篇(二)之用户管理
linux·运维·服务器·增删改查
企业对冲系统官42 分钟前
大宗商品风险对冲系统统计分析功能的技术实现
运维·python·算法·区块链·github·pygame
Web极客码44 分钟前
如何在WordPress登录页面添加隐藏或显示密码按钮
运维·服务器
五度易链-区域产业数字化管理平台1 小时前
行业分析报告|从算法到基因治疗:生物医药行业的数字化转型与人才战略
大数据·人工智能
lipWOFb1 小时前
扩展卡尔曼滤波soc估算 基于EKF算法的锂电池SOC 卡尔曼滤波估计电池soc ,simul...
hive
墨香幽梦客1 小时前
数据库选型对比:MySQL、Oracle与PostgreSQL的企业应用场景分析
数据库·mysql·oracle