Apache Hive介绍

什么是Apache Hive

sql 复制代码
Apache Hive 是一个分布式、容错的数据仓库系统,
可实现大规模分析和 有助于使用 SQL 读取、写入和管理驻留
在分布式存储中的 PB 级数据。

什么是蜂巢

sql 复制代码
Apache Hive 是一个分布式容错数据仓库系统,可实现大规模分析。
 Hive Metastore(HMS)提供了一个中央元数据存储库,可以很容
 易地进行分析,以提供明智的信息。 数据驱动的决策,因此它是
 许多数据湖架构的关键组成部分。 Hive 建立在 Apache Hadoop 
 之上,支持通过 hdfs 在 S3、adls、gs 等上存储。 Hive 允许
 用户使用 SQL 读取、写入和管理 PB 级数据。

hiveserver2

sql 复制代码
HS2 支持多客户端并发和身份验证。 它旨在为 JDBC 和 ODBC 等开放
 API 客户端提供更好的支持。

Hive 元存储服务器 (HMS)

sql 复制代码
Hive 元存储 (HMS) 是关系数据库中 Hive 表和分区元数据的中央存储库,
 并使用元存储服务 API 为客户端(包括 Hive、Impala 和 Spark)提供对
 此信息的访问。 它已成为利用各种开源软件
 (如 Apache Spark 和 Presto)
 的数据湖的构建块。 事实上,一个完整的工具生态系统,
 无论是开源的还是其他的,都是围绕 Hive Metastore 构建的,
 这张图说明了其中的一些。

蜂巢酸

sql 复制代码
Hive 为 ORC 表提供完整的 ACID 支持,并且仅插入支持所有其他格式。

Hive 数据压缩

sql 复制代码
支持基于查询和基于 MR 的数据压缩。
sql 复制代码
## 蜂巢冰山
Hive 为 Apache Iceberg Tables 提供开箱即用的支持,
Apache Iceberg Tables 是一种云原生的 高性能开放表格式,
通过 Hive StorageHandler。

Hive 复制

sql 复制代码
Hive 支持用于备份和恢复的引导和增量复制
相关推荐
wind_one11 小时前
7.基础--SQL--DDL-数据类型及案例
数据库·sql
GM_8281 小时前
从0开始在Go当中使用Apache Thrift框架(万字讲解+图文教程+详细代码)
rpc·go·apache·thrift
l1t2 小时前
利用DeepSeek改写SQLite版本的二进制位数独求解SQL
数据库·人工智能·sql·sqlite
QT 小鲜肉2 小时前
【QT/C++】Qt定时器QTimer类的实现方法详解(超详细)
开发语言·数据库·c++·笔记·qt·学习
研究司马懿2 小时前
【ETCD】ETCD常用命令
网络·数据库·云原生·oracle·自动化·运维开发·etcd
TTBIGDATA2 小时前
【Ambari开启Kerberos】KERBEROS SERVICE CHECK 报错
大数据·运维·hadoop·ambari·cdh·bigtop·ttbigdata
开利网络2 小时前
合规底线:健康产品营销的红线与避坑指南
大数据·前端·人工智能·云计算·1024程序员节
非著名架构师3 小时前
量化“天气风险”:金融与保险机构如何利用气候大数据实现精准定价与投资决策
大数据·人工智能·新能源风光提高精度·疾风气象大模型4.0
Hello.Reader3 小时前
用 CdcUp CLI 一键搭好 Flink CDC 演练环境
大数据·flink
刘一说3 小时前
深入理解 Spring Boot 中的数据库迁移:Flyway 与 Liquibase 实战指南
数据库·spring boot·oracle