hadoop

计算机源码社9 小时前
大数据·hadoop·python·机器学习·数据挖掘·spark·毕业设计
分享一个基于大数据的跨平台内容生态画像与互动等级分析系统,基于Hadoop+Spark的社交媒体互动数据可视化大屏分析💕💕作者:计算机源码社 💕💕个人简介:本人八年开发经验,擅长Java、Python、PHP、.NET、Node.js、Spark、hadoop、Android、微信小程序、爬虫、大数据、机器学习等,大家有这一块的问题可以一起交流! 💕💕学习资料、程序开发、技术解答、文档报告 💕💕如需要源码,可以扫取文章下方二维码联系咨询
BYSJMG12 小时前
大数据·人工智能·hadoop·数据分析·spark·课程设计
计算机毕设选题做什么好?基于大数据的用户健身行为数据分析与可视化系统,Hadoop+Spark处理精彩专栏推荐订阅:在下方主页👇🏻👇🏻👇🏻👇🏻💖🔥作者主页:计算机毕设木哥🔥 💖
ha_lydms1 天前
大数据·hadoop·hdfs·yarn·调度·aliyun·计算
HDFS 简介随着数据量越来越大,一个操作系统已经存不下所有的数据,那么就分配到更多的操作系统管理的磁盘中,但是不方便管理和维护,这时候迫切需要一种系统来管理多台机器上的文件,这就是分布式文件管理系统。HDFS只是分布式文件管理系统中的一种。
2601_962298091 天前
hadoop·python·spark·实战·大数据分析
零基础学大数据分析全栈没有基础, 要是想要去学习“大数据分析全栈”, 首先得明确一个概念, 在大数据所涉及的范围里, 所谓的那种“全栈”, 通常说的是“技术小全栈”。也就是说, 要能够理解数据从产生开始, 一直到产生价值的整个的生命周期, 并且还要能够动手去操作, 这个生命周期包括从数据采集开始, 接着是存储, 然后是计算, 最后到应用。
ha_lydms1 天前
大数据·hadoop·hdfs·mapreduce·yarn·maxcompute·odps
HDFS的读写流程在HDFS写数据的过程中,NameNode会选择距离待上传数据最近距离的DataNode接收数据。那么这个最近距离怎么计算呢? 节点距离:两个节点到达最近的共同祖先的距离总和。
BYSJMG2 天前
大数据·hadoop·分布式·信息可视化·spark·kmeans·课程设计
大数据毕业设计选题推荐:基于大数据的全球气温历史演变分析与可视化,用Hadoop+Spark处理精彩专栏推荐订阅:在下方主页👇🏻👇🏻👇🏻👇🏻💖🔥作者主页:计算机毕设木哥🔥 💖
fastjson_2 天前
数据仓库·hive·hadoop
Hive 自定义函数hive的内置函数满足不了所有的业务需求。hive提供很多的模块可以自定义功能,比如:自定义函数、serde、输入输出格式等。而自定义函数可以分为以下三类: UDF: user defined function:用户自定义函数,一对一的输入输出 (最常用的)。比如abs() UDAF: user defined aggregation function:用户自定义聚合函数,多对一的输入输出,比如:count sum max。 UDTF: user defined table-generate functi
张工在路上4 天前
大数据·hadoop·wpf
WPF 布局基础概述深入了解 WPF 布局基础,并要求详细讲解、代码示例、测试代码、适用场景及使用方法。结合之前的上下文(MVVM 模式、Prism 框架、动态模块加载、模块热加载、模块卸载等),我将提供一个全面的指南,涵盖 WPF 所有主要布局控件的详细讲解,包含代码示例、测试代码、适用场景和使用方法,确保与 Prism 框架和实时消息查看器示例无缝衔接。以下内容将结构化、简洁且详尽,适用于从初学者到高级开发者的需求。
BYSJMG4 天前
大数据·hadoop·信息可视化·django·自动驾驶·kmeans·课程设计
计算机毕设选题|基于大数据与文本挖掘的自动驾驶事故成因分析及可视化研究|Hadoop+PySpark+Django+Vue精彩专栏推荐订阅:在下方主页👇🏻👇🏻👇🏻👇🏻💖🔥作者主页:计算机毕设木哥🔥 💖
BI专家之路5 天前
linux·hive·hadoop
安装linux/hadoop/jdk/hive如果内存只有 8G:只搭建伪分布式(单节点),不要做 3 台完全分布式集群,否则电脑巨卡CentOS7 ISO 镜像,选择 Minimal 最小化安装(节省资源) 备选:Ubuntu 20.04(文档多,新版推荐)
2601_962073977 天前
大数据·hadoop·架构
大数据-258 离线数仓 - Griffin架构 配置安装 Livy 架构设计 解压配置 Hadoop Hive点一下关注吧!!!非常感谢!!持续更新!!!----------------------Java篇开始了!---------目前开始更新 MyBatis,一起深入浅出!目前已经更新到了:---------* Hadoop(已更完)* HDFS(已更完)* MapReduce(已更完)* Hive(已更完)* Flume(已更完)* Sqoop(已更完)* Zookeeper(已更完)* HBase(已更完)* Redis (已更完)* Kafka(已更完)* Spark(已更完)* Flink(已更完)*
fastjson_7 天前
数据仓库·hive·hadoop
Hive 基础函数unix_timestamp 函数是将一个字符串,变为了一个时间戳 from_unixtime 函数是将时间戳变为了一个字符串
kuroomi7 天前
hadoop
hadoop高可用架构IP主机名角色192.168.150.172server1NameNodeDFSZKFailoverController
千里码aicood8 天前
大数据·hadoop·分布式
基于Hadoop的汽车销量分析与可视化基于Hadoop的汽车销量分析与可视化摘 要本系统是一款基于Hadoop的汽车销量分析与可视化系统,融合了Hadoop、Django和Vue等多种技术。在数据处理方面,Hadoop凭借其强大的分布式存储和计算能力,能够高效地处理海量的汽车销售数据,为后续的分析提供坚实的数据基础。Django作为后端开发框架,负责处理前端发送的请求,与Hadoop集群进行交互,获取所需的数据,并返回给前端。Vue则用于构建前端页面,实现用户与系统的交互,展示各种可视化图表和数据分析结果。
wxchyy10 天前
hadoop·阿里云·docker·云原生·华为云·云计算·运维开发
手把手教你入门云计算(二):这些技术改变了世界,你也能轻松掌握由于笔者上一篇只是总结了基础知识方面,这一篇开始走进云计算核心技术方面,还是照旧,我会以尽量用简单的语言来总结知识点。话不多说,坐稳扶好,咱们开始!!!如果不熟悉基础知识的可以看笔者的上篇文章。
BD_Marathon10 天前
大数据·hadoop·分布式
Hadoop组成Hadoop1.x组成: Hdfs(数据存储) Common(辅助工具) MapReduce(计算+资源调度)
邀星月为媒10 天前
hive·hadoop·gitee
正式迁移 Gitee:core-site-hive 与 core-hive-agent 后续更新只认这两个地址如果你之前关注过 core-site-hive 或 core-hive-agent,这篇文章请收藏一下。
BD_Marathon10 天前
java·大数据·hadoop
Hadoop常用端口号Hadoop3.xHDFS NameNode 内部通常端口:8020/9000/9820 HDFS NameNode 对用户的查询端口:9870 历史服务器:19888 Yarn查看任务运行情况的:8088
fastjson_11 天前
数据仓库·hive·hadoop
Hive 复杂数据类型Hive 复杂数据类型有三种,分别是Array Map Struct说明:下标从0开始,越界不报错,以null代替
爱吃面的猫11 天前
大数据·hadoop·flume
大数据Hadoop之——集群环境搭建(了解)目录前期准备一、JDK的安装1、安装jdk2、配置Java环境变量3、加载环境变量4、进行校验二、hadoop的环境搭建