HBase的数据定义与操作

一、实验目的

  1. 理解分布式数据存储的基本概念和原理。

  2. 掌握HBase的基本操作,包括表的创建、删除、数据的查询、插入和删除等。

  3. 学习使用HBase的命令行shell工具进行数据操作。

  4. 理解HBase中的过滤查询机制。

二、实验环境准备

  1. JAVA环境准备:确保Java Development Kit (JDK) 已安装并配置好环境变量。

  2. Hadoop环境准备:安装并配置Hadoop环境,确保Hadoop的各个组件可以在伪分布式模式下运行。

三、实验教材参考

《大数据存储》,谭旭,人民邮电出版社,2022,ISBN 978-7-115-59414-3。

四、实验内容与步骤

1、创建表

设计一个简单的表结构,例如学生信息表(Students),包含两个列族:基本信息(info)和成绩信息(scores)。

使用 create 'Students', 'info', 'scores' 命令创建表

2、插入数据

向Students表中插入几条学生记录,插入至少3名学生的信息和成绩。

3、查询表数据

使用 scan 'Students' 命令查询并显示表中的所有数据。

使用 get 'Students', 'student1' 命令查询特定学生的信息。

4、过滤查询

使用过滤器查询特定条件的记录,例如查询数学成绩大于85分的学生:

scan 'Students', {COLUMNS => 'scores:math', FILTER => "ValueFilter( >, 'binary:85')"}

5、删除数据

删除一条学生记录,例如删除student1的记录:deleteall 'Students', 'student1'

6、删除表

在删除表之前,需要先禁用表:

disable 'Students'

使用 drop 'Students' 命令删除表。

相关推荐
岁岁种桃花儿21 小时前
MySQL从入门到精通系列:InnoDB记录存储结构
数据库·mysql
jiunian_cn1 天前
【Redis】hash数据类型相关指令
数据库·redis·哈希算法
冉冰学姐1 天前
SSM在线影评网站平台82ap4(程序+源码+数据库+调试部署+开发环境)带论文文档1万字以上,文末可获取,系统界面在最后面
数据库·ssm框架·在线影评平台·影片分类
Guheyunyi1 天前
智能守护:视频安全监测系统的演进与未来
大数据·人工智能·科技·安全·信息可视化
知识分享小能手1 天前
SQL Server 2019入门学习教程,从入门到精通,SQL Server 2019数据库的操作(2)
数据库·学习·sqlserver
发哥来了1 天前
主流AI视频生成商用方案选型评测:五大核心维度对比分析
大数据·人工智能
数研小生1 天前
做京东评论分析系统11年,京东评论数据接口解析
大数据
踩坑小念1 天前
秒杀场景下如何处理redis扣除状态不一致问题
数据库·redis·分布式·缓存·秒杀
金融小师妹1 天前
基于LSTM-GARCH-EVT混合模型的贵金属极端波动解析:黄金白银双双反弹的逻辑验证
大数据·人工智能·深度学习·机器学习
萧曵 丶1 天前
MySQL 语句书写顺序与执行顺序对比速记表
数据库·mysql