spark

AIsocial6 小时前
spark·tiktok
Spark Ads怎么用?自然流量测试内容,再用付费流量放大TikTok付费投流并不只有传统的信息流广告。除了广告主单独制作广告素材、设置目标人群后直接投放之外,还有一种更适合放大已有优质内容的方式——Spark Ads。
IT毕设梦工厂1 天前
大数据·hadoop·python·信息可视化·spark·课程设计·大数据毕设项目
计算机毕业设计选题推荐:基于大数据的印度上市公司财务指标数据可视化分析|毕业设计选题|计算机毕设|选题推荐|毕设指导|项目定制|源码|高质量项目✨作者主页:IT毕设梦工厂✨ 个人简介:曾从事计算机专业培训教学,擅长Java、Python、PHP、.NET、Node.js、GO、微信小程序、安卓Android等项目实战。接项目定制开发、代码讲解、答辩教学、文档编写、降重等。 ☑文末获取源码☑ 精彩专栏推荐⬇⬇⬇ Java项目 Python项目 安卓项目 微信小程序项目
BYSJMG1 天前
大数据·hadoop·信息可视化·数据分析·spark·kmeans·课程设计
计算机毕业设计选题推荐:基于大数据的水质多指标关联分析与可视化的设计与实现,Spark 加 K-Means 做水质分群精彩专栏推荐订阅:在下方主页👇🏻👇🏻👇🏻👇🏻💖🔥作者主页:计算机毕设木哥🔥 💖
计算机源码社1 天前
大数据·hadoop·python·数据挖掘·spark·毕业设计·课程设计
【大数据项目实战】基于Python数据挖掘的新能源车充电行为关联风险分析研究-基于Hadoop+Spark的电动汽车故障多维数据可视化💕💕作者:计算机源码社 💕💕个人简介:本人八年开发经验,擅长Java、Python、PHP、.NET、Node.js、Spark、hadoop、Android、微信小程序、爬虫、大数据、机器学习等,大家有这一块的问题可以一起交流! 💕💕学习资料、程序开发、技术解答、文档报告 💕💕如需要源码,可以扫取文章下方二维码联系咨询
HanhahnaH1 天前
大数据·分布式·spark
Spark 任务如何实现幂等?Spark 任务在分布式环境中运行,天然面临节点故障、网络超时、任务重试等不可靠因素。幂等性保障的核心目标是:无论 Spark 作业因为何种原因执行多少次,最终产生的输出状态与只执行一次完全一致。结合原文的确定性回放思路以及其他技术实践,我将 Spark 任务幂等性拆解为四个层次来讨论。
乌恩大侠2 天前
ubuntu·docker·容器·spark·o-ru·ai-ran
【Sionna】docker build ubuntu cuda
BYSJMG3 天前
大数据·hadoop·信息可视化·数据分析·spark·kmeans·课程设计
计算机毕设选题推荐:基于大数据的公共交通运营数据分析与可视化,Spark+K-Means聚类城市运营模式精彩专栏推荐订阅:在下方主页👇🏻👇🏻👇🏻👇🏻💖🔥作者主页:计算机毕设木哥🔥 💖
绿算技术4 天前
人工智能·科技·算法·架构·spark
Solidigm联合绿算技术共同发布《面向 SOHO AI 推理的存储扩展方案》技术白皮书————基于绿算技术存储节点与 Solidigm NVMe SSD 的 DGX Spark KV Cache Offload 实践
阿里云大数据AI技术4 天前
人工智能·spark·gpu
EMR Serverless Spark:CPU + GPU 异构计算使用指南想做 AI 推理、模型训练、或者 GPU 加速的数据处理?阿里云 EMR Serverless Spark 支持 CPU 和 GPU 异构计算,开箱即用,不用自己花费时间搭集群。本文手把手教你怎么在EMR Serverless Spark产品中买到 GPU 资源,买到之后怎么跑起来。
BYSJMG5 天前
大数据·python·信息可视化·数据分析·spark·课程设计·美食
计算机毕设选题做什么好?基于大数据的用户美食数据分析与可视化,PySpark预处理+ECharts大屏,含Isolation Forest异常检测算法精彩专栏推荐订阅:在下方主页👇🏻👇🏻👇🏻👇🏻💖🔥作者主页:计算机毕设木哥🔥 💖
2601_962295995 天前
python·spark·kafka·情感分析·大规模处理
Spark 和 Kafka 实现 Python 大规模情感分析用 Spark 和 Kafka 实现 大规模情感分析引言:为什么你的笔记本电脑在处理几百万条数据时会“崩溃”?
fastjson_5 天前
大数据·分布式·spark
Spark 安装和使用HDFS 是大数据常用分布式存储,Hive 提供 HiveQL,不存储业务数据,数据存放于 HDFS第一代计算引擎:MapReduce:用廉价机器实现分布式大数据处理
计算机源码社5 天前
大数据·hadoop·python·机器学习·数据挖掘·spark·毕业设计
分享一个基于大数据的跨平台内容生态画像与互动等级分析系统,基于Hadoop+Spark的社交媒体互动数据可视化大屏分析💕💕作者:计算机源码社 💕💕个人简介:本人八年开发经验,擅长Java、Python、PHP、.NET、Node.js、Spark、hadoop、Android、微信小程序、爬虫、大数据、机器学习等,大家有这一块的问题可以一起交流! 💕💕学习资料、程序开发、技术解答、文档报告 💕💕如需要源码,可以扫取文章下方二维码联系咨询
BYSJMG5 天前
大数据·人工智能·hadoop·数据分析·spark·课程设计
计算机毕设选题做什么好?基于大数据的用户健身行为数据分析与可视化系统,Hadoop+Spark处理精彩专栏推荐订阅:在下方主页👇🏻👇🏻👇🏻👇🏻💖🔥作者主页:计算机毕设木哥🔥 💖
2601_962298096 天前
hadoop·python·spark·实战·大数据分析
零基础学大数据分析全栈没有基础, 要是想要去学习“大数据分析全栈”, 首先得明确一个概念, 在大数据所涉及的范围里, 所谓的那种“全栈”, 通常说的是“技术小全栈”。也就是说, 要能够理解数据从产生开始, 一直到产生价值的整个的生命周期, 并且还要能够动手去操作, 这个生命周期包括从数据采集开始, 接着是存储, 然后是计算, 最后到应用。
用户3610588626127 天前
大数据·spark
SparkStreaming 之 Kafka 与 SparkStreaming 参数配置详解摘要:Kafka 和 Spark Streaming 对接,两侧都有一堆参数,很多还会互相影响——拉取速率是两边一起管的,offset 也是两边一起管的,配置不对轻则吞吐上不去,重则丢数据或重复消费。这篇把两侧参数按职责拆开,重点讲四个会打架的地方(auto.commit、offset.reset、两侧限流、consumer cache),以及它们怎么协同。
BYSJMG7 天前
大数据·hadoop·分布式·信息可视化·spark·kmeans·课程设计
大数据毕业设计选题推荐:基于大数据的全球气温历史演变分析与可视化,用Hadoop+Spark处理精彩专栏推荐订阅:在下方主页👇🏻👇🏻👇🏻👇🏻💖🔥作者主页:计算机毕设木哥🔥 💖
IT研究室7 天前
大数据·spark·课程设计
最新大数据毕业设计选题推荐-基于大数据的水质多指标关联分析与可视化的设计与实现-大数据-Spark-Hadoop-Bigdata✨作者主页:IT研究室✨ 个人简介:曾从事计算机专业培训教学,擅长Java、Python、微信小程序、Golang、安卓Android等项目实战。接项目定制开发、代码讲解、答辩教学、文档编写、降重等。 ☑文末获取源码☑ 精彩专栏推荐⬇⬇⬇ Java项目 Python项目 安卓项目 微信小程序项目
用户3610588626128 天前
大数据·spark
SparkStreaming 之配置参数详解摘要:Spark Streaming 的配置参数几十个,但真正需要你动手调的就那么几个,剩下的调错了反而添乱。这篇把参数按功能分六类,重点讲五个高频参数(blockInterval、反压、concurrentJobs、unpersist、stopGracefully)的默认值、什么时候该动、以及动了之后会踩的坑。
用户3610588626128 天前
大数据·spark
SparkStreaming 之 Direct 模式并行度设置与 offset 管理摘要:Direct 模式上线前有两个问题绕不开:并行度怎么调,offset 怎么管。前者很多人栽在"executor 加了不少,吞吐还是上不去"上——因为 Direct 模式的并行度天花板是 Kafka 分区数;后者决定你能否做到 exactly-once。这篇把这两个问题一次讲清,各给一套能落地的配置和代码。