object Cache {
// spark的缓存
// 1. cache()
// 2. persist()
// cache()是persist()的一种特殊情况,默认只使用内存
def main(args: Array[String]): Unit = {
//创建spark
val conf = new SparkConf().setAppName("Cache").setMaster("local[*]")
val sc = new SparkContext(conf)
sc.setLogLevel("WARN")
// 创建一个包含大量随机数的RDD
val rdd = sc.parallelize(1 to 10000000).map(_ => scala.util.Random.nextInt(100))
//定义一个复杂的转换函数
def complexTransformation(x: Int): Int = {
var result = x
for (i <- 1 to 1000) {
result = result * 2 % 100
}
result
}
// val rdd1 = rdd.map(complexTransformation)
// 缓存rdd
//val rdd1 = rdd.map(complexTransformation).cache()
// persist
val rdd1 = rdd.map(complexTransformation).persist(StorageLevel.DISK_ONLY)
// 第一次触发行动算子,计算并统计消耗的时间
val startTime = System.currentTimeMillis()
val rs1 = rdd1.count()
val endTime = System.currentTimeMillis()
println(s"第一次计算结果:$rs1,耗时:${endTime - startTime}毫秒")
// 第一次触发行动算子,计算并统计消耗的时间
val startTime1 = System.currentTimeMillis()
val rs2 = rdd1.count()
val endTime1 = System.currentTimeMillis()
println(s"第二次计算结果:$rs2,耗时:${endTime1 - startTime1}毫秒")
}
}
spark的缓存
只因只因爆2025-05-15 19:40
相关推荐
北方的银狐-Zero8 小时前
ERP 管执行,数据管标准,OntoL本体 管思考:企业智能化升级的规划图四季豆338 小时前
数据质量管理的内涵与评估净水深流9 小时前
中央厨房冷链技术实践:多温区改造、WMS落地与IoT温控架构是Yu欸10 小时前
鸿蒙PC移植:2048 从网页小游戏到 AI 桌面应用智搜广告10 小时前
智搜广告:科技行业AI回答优化公司如何破局湘美书院--湘美谈教育11 小时前
湘美书院AI时代的禅悟集:人机智能,反照诸我电商API_1800790524713 小时前
拍照找同款是怎么实现的?淘宝以图搜图接口 item_search_img 对接实战洋洋不叫杨杨14 小时前
Codex 实战:用 AI 写运维脚本Regentsoft丽晶软件15 小时前
即时零售退货的库存归属、质检标准和退款时效,系统如何做到自动闭环