hive

卷毛迷你猪2 天前
hive·hadoop
快速实验篇(A11)数据集成与多维分析:从单实验产出到跨实验宽表本文是"农业气象干旱分析"项目快速实验篇的第十一阶段,也是快速实验篇的收尾。前十个实验各自产出了一张表、一份结论,但彼此孤立。A5 知道每天每站的干旱等级,A6 知道每站每年的天数统计和事件清单,A8 有 Gamma 拟合参数和 severe_ratio,A9-1 有六组相关系数,A10 有 SPI 标准化结果。问题是,这些表从没被放在一起看过。
Francek Chen3 天前
大数据·数据仓库·hive·hadoop·分布式
【大数据处理与分析】数据仓库Hive:04 数据仓库Hive概述【作者主页】Francek Chen 【专栏介绍】 ⌈ ⌈ ⌈大数据技术原理与应用 ⌋ ⌋ ⌋专栏系统介绍大数据的相关知识,分为大数据基础篇、大数据存储与管理篇、大数据处理与分析篇、大数据应用篇。内容包含大数据概述、大数据处理架构Hadoop、分布式文件系统HDFS、分布式数据库HBase、NoSQL数据库、云数据库、MapReduce、Hadoop再探讨、数据仓库Hive、Spark、流计算、Flink、图计算、数据可视化,以及大数据在互联网领域、生物医学领域的应用和大数据的其他应用。 【GitCode
姜穆澜4 天前
大数据·hive
Apache Hive 4.x 完全学习指南写作时间:2026 年初。文中版本信息均核对自 Apache Hive 官网、ASF 官方公告、Apache 董事会月报与 Hive/Iceberg 官方文档。截至发稿,Hive 最新稳定版为 4.2.0(2025-11-23 发布),4.1.0、4.0.x 仍在广泛使用,4.3.0 已进入规划。本文所有"默认行为""支持/不支持"的结论,均以 4.x 社区版为准,并在涉及商业发行版差异处单独标注。
Gl�ria8 天前
hive·hadoop·sql
Hive SQL 执行卡住完整排查 & 处理现象:Hive 提交 SQL 之后,任务长时间不动,Map 或者 Reduce 停在某个百分比不动,不报错、不失败,就是卡住。
网络豆10 天前
hive·apache·harmonyos
Apache Hive 鸿蒙 PC 适配全记录:以 Qt 客户端打通 HiveQL、监控与元数据访问适配开源地址:https://atomgit.com/OpenHarmonyPCDeveloper/ohos_hive
fastjson_11 天前
hive
Hive3.1.3 安装使用我们之前安装了Hive4.0.1,但是Spark使用的是3.5.9,和Hive4.0.1不太兼容,所以现在安装Hive3.1.3稳定版。
Gl�ria15 天前
hive·hadoop·mapreduce
Hadoop MapReduce/Hive 数据倾斜完整排查数据倾斜本质:Shuffle 阶段,某一个 / 某几个 Reduce 接收的数据量远大于其他 Reduce,任务长时间卡在这几个 Reduce,出现长尾任务,严重时 OOM。
Gl�ria15 天前
数据仓库·hive·hadoop
Hadoop Hive 和 YARN 的关系一句话总结:Hive 是数仓 SQL 工具,本身不做计算;YARN 是 Hadoop 的资源调度管理器,给 Hive 的计算任务分配服务器资源,运行 MapReduce/Tez/Spark 计算程序;
fastjson_19 天前
数据仓库·hive·hadoop
Hive 自定义函数hive的内置函数满足不了所有的业务需求。hive提供很多的模块可以自定义功能,比如:自定义函数、serde、输入输出格式等。而自定义函数可以分为以下三类: UDF: user defined function:用户自定义函数,一对一的输入输出 (最常用的)。比如abs() UDAF: user defined aggregation function:用户自定义聚合函数,多对一的输入输出,比如:count sum max。 UDTF: user defined table-generate functi
Gent_倪19 天前
数据库·hive·mysql
MySQL 与 Hive 语法异同点详解MySQL 是传统关系型 OLTP 数据库,面向在线事务处理,主打低延迟、高并发的行级读写;Hive 是基于 Hadoop 的数据仓库 OLAP 工具,通过 HQL(类 SQL)将查询转为 MapReduce/Spark 任务,面向海量数据离线分析。
邀星月为媒22 天前
人工智能·hive·开源
从零打造一个属于自己的 AI Agent:Core Hive Agent 开源项目解析不只是调用大模型,而是构建一个真正具备任务理解、记忆管理、工具调用和自主决策能力的智能体。项目地址:https://gitee.com/xiaobait9/core-hive-agent
BI专家之路22 天前
linux·hive·hadoop
安装linux/hadoop/jdk/hive如果内存只有 8G:只搭建伪分布式(单节点),不要做 3 台完全分布式集群,否则电脑巨卡CentOS7 ISO 镜像,选择 Minimal 最小化安装(节省资源) 备选:Ubuntu 20.04(文档多,新版推荐)
fastjson_24 天前
数据仓库·hive·hadoop
Hive 基础函数unix_timestamp 函数是将一个字符串,变为了一个时间戳 from_unixtime 函数是将时间戳变为了一个字符串
邀星月为媒1 个月前
hive·hadoop·gitee
正式迁移 Gitee:core-site-hive 与 core-hive-agent 后续更新只认这两个地址如果你之前关注过 core-site-hive 或 core-hive-agent,这篇文章请收藏一下。
fastjson_1 个月前
数据仓库·hive·hadoop
Hive 复杂数据类型Hive 复杂数据类型有三种,分别是Array Map Struct说明:下标从0开始,越界不报错,以null代替
hopsky1 个月前
数据仓库·hive·hadoop
《Hive性能调优实战》核心内容详细解读(作者:林志煌,机械工业出版社,2020年出版,ISBN:9787111644323)《Hive性能调优实战》是一本关于Apache Hive调优的专业书籍,旨在介绍如何进行Hive性能调优,以及调优时所涉及的工具。书中重点介绍了Hive性能调优所涉及的Hadoop组件和Hive工具。这是一本实战导向的技术书籍,作者林志煌曾在中国互联网头部公司长期从事大数据相关项目的研发,经手过日数据流量TB级别和总量PB级别的Hadoop大数据平台建设,具有丰富的生产环境经验。
赤土 炙焱1 个月前
hive·hadoop
hiveserver2启动失败,磁盘满了hiveserver2 连接失败,查看日志,磁盘满了查看磁盘情况查看内存占用大小du -sh /var/* | sort -h
Waay1 个月前
大数据·数据库·hive·hadoop·hdfs·hbase
什么是HBase?它和Hive有什么区别?Hive:离线大数据仓库,存日志、订单批量数据,只能做批量统计查询,不能实时根据某一条 ID 快速查数据;
Francek Chen1 个月前
大数据·数据仓库·hive·hadoop·分布式·数据分析
【大数据处理与分析】数据仓库Hive:02 数据湖【作者主页】Francek Chen 【专栏介绍】 ⌈ ⌈ ⌈大数据技术原理与应用 ⌋ ⌋ ⌋专栏系统介绍大数据的相关知识,分为大数据基础篇、大数据存储与管理篇、大数据处理与分析篇、大数据应用篇。内容包含大数据概述、大数据处理架构Hadoop、分布式文件系统HDFS、分布式数据库HBase、NoSQL数据库、云数据库、MapReduce、Hadoop再探讨、数据仓库Hive、Spark、流计算、Flink、图计算、数据可视化,以及大数据在互联网领域、生物医学领域的应用和大数据的其他应用。 【GitCode
fastjson_1 个月前
数据仓库·hive·hadoop
Hive的介绍和使用Hive 是一个框架,可以通过编写sql的方式,自动的编译为MR任务的一个工具。 在这个世界上,会写SQL的人远远大于会写java代码的人,所以假如可以将MR通过sql实现,这个将是一个巨大的市场,FaceBook就这么干。(脸书)