技术栈
hadoop
2601_96229809
18 分钟前
hadoop
·
python
·
spark
·
实战
·
大数据分析
零基础学大数据分析全栈
没有基础, 要是想要去学习“大数据分析全栈”, 首先得明确一个概念, 在大数据所涉及的范围里, 所谓的那种“全栈”, 通常说的是“技术小全栈”。也就是说, 要能够理解数据从产生开始, 一直到产生价值的整个的生命周期, 并且还要能够动手去操作, 这个生命周期包括从数据采集开始, 接着是存储, 然后是计算, 最后到应用。
ha_lydms
8 小时前
大数据
·
hadoop
·
hdfs
·
mapreduce
·
yarn
·
maxcompute
·
odps
HDFS的读写流程
在HDFS写数据的过程中,NameNode会选择距离待上传数据最近距离的DataNode接收数据。那么这个最近距离怎么计算呢? 节点距离:两个节点到达最近的共同祖先的距离总和。
BYSJMG
1 天前
大数据
·
hadoop
·
分布式
·
信息可视化
·
spark
·
kmeans
·
课程设计
大数据毕业设计选题推荐:基于大数据的全球气温历史演变分析与可视化,用Hadoop+Spark处理
精彩专栏推荐订阅:在下方主页👇🏻👇🏻👇🏻👇🏻💖🔥作者主页:计算机毕设木哥🔥 💖
fastjson_
1 天前
数据仓库
·
hive
·
hadoop
Hive 自定义函数
hive的内置函数满足不了所有的业务需求。hive提供很多的模块可以自定义功能,比如:自定义函数、serde、输入输出格式等。而自定义函数可以分为以下三类: UDF: user defined function:用户自定义函数,一对一的输入输出 (最常用的)。比如abs() UDAF: user defined aggregation function:用户自定义聚合函数,多对一的输入输出,比如:count sum max。 UDTF: user defined table-generate functi
张工在路上
3 天前
大数据
·
hadoop
·
wpf
WPF 布局基础概述
深入了解 WPF 布局基础,并要求详细讲解、代码示例、测试代码、适用场景及使用方法。结合之前的上下文(MVVM 模式、Prism 框架、动态模块加载、模块热加载、模块卸载等),我将提供一个全面的指南,涵盖 WPF 所有主要布局控件的详细讲解,包含代码示例、测试代码、适用场景和使用方法,确保与 Prism 框架和实时消息查看器示例无缝衔接。以下内容将结构化、简洁且详尽,适用于从初学者到高级开发者的需求。
BYSJMG
3 天前
大数据
·
hadoop
·
信息可视化
·
django
·
自动驾驶
·
kmeans
·
课程设计
计算机毕设选题|基于大数据与文本挖掘的自动驾驶事故成因分析及可视化研究|Hadoop+PySpark+Django+Vue
精彩专栏推荐订阅:在下方主页👇🏻👇🏻👇🏻👇🏻💖🔥作者主页:计算机毕设木哥🔥 💖
BI专家之路
4 天前
linux
·
hive
·
hadoop
安装linux/hadoop/jdk/hive
如果内存只有 8G:只搭建伪分布式(单节点),不要做 3 台完全分布式集群,否则电脑巨卡CentOS7 ISO 镜像,选择 Minimal 最小化安装(节省资源) 备选:Ubuntu 20.04(文档多,新版推荐)
2601_96207397
6 天前
大数据
·
hadoop
·
架构
大数据-258 离线数仓 - Griffin架构 配置安装 Livy 架构设计 解压配置 Hadoop Hive
点一下关注吧!!!非常感谢!!持续更新!!!----------------------Java篇开始了!---------目前开始更新 MyBatis,一起深入浅出!目前已经更新到了:---------* Hadoop(已更完)* HDFS(已更完)* MapReduce(已更完)* Hive(已更完)* Flume(已更完)* Sqoop(已更完)* Zookeeper(已更完)* HBase(已更完)* Redis (已更完)* Kafka(已更完)* Spark(已更完)* Flink(已更完)*
fastjson_
6 天前
数据仓库
·
hive
·
hadoop
Hive 基础函数
unix_timestamp 函数是将一个字符串,变为了一个时间戳 from_unixtime 函数是将时间戳变为了一个字符串
kuroomi
6 天前
hadoop
hadoop高可用架构
IP主机名角色192.168.150.172server1NameNodeDFSZKFailoverController
千里码aicood
7 天前
大数据
·
hadoop
·
分布式
基于Hadoop的汽车销量分析与可视化
基于Hadoop的汽车销量分析与可视化摘 要本系统是一款基于Hadoop的汽车销量分析与可视化系统,融合了Hadoop、Django和Vue等多种技术。在数据处理方面,Hadoop凭借其强大的分布式存储和计算能力,能够高效地处理海量的汽车销售数据,为后续的分析提供坚实的数据基础。Django作为后端开发框架,负责处理前端发送的请求,与Hadoop集群进行交互,获取所需的数据,并返回给前端。Vue则用于构建前端页面,实现用户与系统的交互,展示各种可视化图表和数据分析结果。
wxchyy
9 天前
hadoop
·
阿里云
·
docker
·
云原生
·
华为云
·
云计算
·
运维开发
手把手教你入门云计算(二):这些技术改变了世界,你也能轻松掌握
由于笔者上一篇只是总结了基础知识方面,这一篇开始走进云计算核心技术方面,还是照旧,我会以尽量用简单的语言来总结知识点。话不多说,坐稳扶好,咱们开始!!!如果不熟悉基础知识的可以看笔者的上篇文章。
BD_Marathon
9 天前
大数据
·
hadoop
·
分布式
Hadoop组成
Hadoop1.x组成: Hdfs(数据存储) Common(辅助工具) MapReduce(计算+资源调度)
邀星月为媒
9 天前
hive
·
hadoop
·
gitee
正式迁移 Gitee:core-site-hive 与 core-hive-agent 后续更新只认这两个地址
如果你之前关注过 core-site-hive 或 core-hive-agent,这篇文章请收藏一下。
BD_Marathon
9 天前
java
·
大数据
·
hadoop
Hadoop常用端口号
Hadoop3.xHDFS NameNode 内部通常端口:8020/9000/9820 HDFS NameNode 对用户的查询端口:9870 历史服务器:19888 Yarn查看任务运行情况的:8088
fastjson_
10 天前
数据仓库
·
hive
·
hadoop
Hive 复杂数据类型
Hive 复杂数据类型有三种,分别是Array Map Struct说明:下标从0开始,越界不报错,以null代替
爱吃面的猫
10 天前
大数据
·
hadoop
·
flume
大数据Hadoop之——集群环境搭建(了解)
目录前期准备一、JDK的安装1、安装jdk2、配置Java环境变量3、加载环境变量4、进行校验二、hadoop的环境搭建
一路向北finish
10 天前
大数据
·
linux
·
运维
·
服务器
·
hadoop
·
openstack
《Hadoop 高可用集群与 OpenStack Mitaka 控制节点部署全流程实操排坑指南》
本次实操分为两大模块:先基于ZooKeeper搭建三节点协调集群,在此基础上完成HDFS HA与YARN HA全栈高可用部署,并验证自动故障切换;后半段从零搭建OpenStack Mitaka控制节点基础环境,完成数据库、消息队列等依赖服务部署,以及Keystone身份服务全流程验证。全程踩坑不少,下面按操作顺序完整复盘。
insertYam
10 天前
大数据
·
hadoop
·
架构
[hadoop高可用架构]
Hadoop 、jdk、zookeeper程序使用nfs共享同步配置文件软件版本:hadoop-3.3.6.tar.gz
hopsky
10 天前
数据仓库
·
hive
·
hadoop
《Hive性能调优实战》核心内容详细解读
(作者:林志煌,机械工业出版社,2020年出版,ISBN:9787111644323)《Hive性能调优实战》是一本关于Apache Hive调优的专业书籍,旨在介绍如何进行Hive性能调优,以及调优时所涉及的工具。书中重点介绍了Hive性能调优所涉及的Hadoop组件和Hive工具。这是一本实战导向的技术书籍,作者林志煌曾在中国互联网头部公司长期从事大数据相关项目的研发,经手过日数据流量TB级别和总量PB级别的Hadoop大数据平台建设,具有丰富的生产环境经验。