Hive实战任务 - 9.2 统计总分与平均分

文章目录

  • [1. 实战概述](#1. 实战概述)
  • [2. 实战步骤](#2. 实战步骤)
  • [3. 实战总结](#3. 实战总结)

1. 实战概述

  • 本实战通过Hive处理学生成绩数据,创建内部表加载HDFS中的score.txt文件,利用SQL计算每位学生的总分与平均分,并以分列式和三元组格式输出结果,最终将统计结果持久化至HDFS目录,完整展示了Hive在结构化数据分析中的应用流程。

2. 实战步骤

3. 实战总结

  • 本次实战围绕学生成绩分析,系统完成了从数据准备到结果输出的全过程。首先在本地创建包含姓名及五科成绩的文本文件并上传至HDFS;接着在Hive中定义内部表t_score,指定字段分隔符为空格,并通过LOAD DATA加载数据;随后使用SQL表达式对各科成绩求和并计算平均分,结合ROUND函数保留一位小数,确保结果精度;通过CONCAT函数将结果格式化为指定三元组形式;最后利用INSERT OVERWRITE DIRECTORY将查询结果导出至HDFS输出路径。整个过程体现了Hive对结构化数据的高效处理能力,强化了对表创建、数据加载、聚合计算及结果持久化的理解,为后续教育或业务场景中的批量数据分析提供了可复用的实践范式。
相关推荐
TPBoreas7 小时前
springboot3.5比2.x做了哪儿些提升
数据仓库·hive·hadoop
Nefu_lyh2 天前
【Hive】七、Hive 函数:聚合 / 统计 / 分位数 / 集合 / 高级分组
数据仓库·hive·hadoop
KANGBboy2 天前
hive UDF函数
数据仓库·hive·hadoop
王小王-1234 天前
基于商品评价的评论情感分析与可视化系统
hive·情感分析·商品评价分析·主题分析·商品评论分析
Nefu_lyh4 天前
【Hive】 八、Hive 计算引擎:MapReduce / Tez / Spark 对比与选型
hive·spark·mapreduce
白日与明月5 天前
Hive子查询中的ORDER BY陷阱:为什么排序“消失”了?
数据仓库·hive·hadoop
Nefu_lyh6 天前
【Hive】六、Hive 运算逻辑:数学 / 逻辑 / 条件 / 日期 / 字符串函数
数据仓库·hive·hadoop
AQin10127 天前
【对比向】既生瑜何生亮?不!Hive 和 Doris不一样
数据仓库·hive·hadoop·doris
AQin10127 天前
【对比向】细算“成本”——Hive vs. Doris
大数据·数据库·hive·doris·实时数仓
青春万岁!!8 天前
hive分区表加字段后insert字段为空
数据仓库·hive·hadoop