Scala相关知识学习总结6

1、集合计算高级函数说明

  • 过滤:遍历集合,提取满足特定条件的元素组成新集合。

  • 转化/映射(map):将集合里的每个元素应用到指定函数进行转换。

  • 扁平化:文档未详细阐述其具体含义和操作。

  • 扁平化+映射(flatMap):先对集合元素执行映射操作,再将结果扁平化,即集合中每个元素的子元素映射到某个函数并返回新集合。

  • 分组(group):按照给定规则对集合元素进行分组。

  • 简化(归约):通过特定逻辑聚合集合中的数据,减少数据量以获得最终结果。

  • 折叠:属于化简的特殊形式。

2、集合计算高级函数实操

  • Demo01示例:利用`Demo01`对象,对`List`集合进行过滤、映射、扁平化、扁平化+映射和分组的实际操作演示,例如从`List(1, 2, 3, 4, 5, 6, 7, 8, 9)`中筛选偶数、对每个元素加1等。
  • Reduce方法:通过指定的逻辑将集合中的数据进行聚合,从而减少数据,最终获取结果。
  • Fold方法:展示`fold`方法的基本使用,其底层为`foldLeft`,并演示用`foldLeft`合并两个`Map`集合的操作。

两个集合合并

3、普通WordCount案例

  • 需求:对集合中出现的相同单词进行计数,并获取计数排名前三的结果。

  • 实操步骤:先将包含多个字符串的集合中的每个字符串拆分成单个单词;然后把相同的单词分组;接着对每组单词进行计数;再将计数结果按降序排序;最后取排序后的前三个结果。

相关推荐
强化实验室2 小时前
如何设计基于吖啶生物素,Acridinium-Biotin的高效生物检测体系?
flask·scala·pyqt·fastapi·web3.py
m0_748254667 天前
Perl 变量类型
spark·scala·perl
是阿威啊18 天前
【用户行为归因分析项目】- 【企业级项目开发第五站】数据采集并加载到hive表
大数据·数据仓库·hive·hadoop·spark·scala
是阿威啊21 天前
【用户行为归因分析项目】- 【企业级项目开发第四站】模拟三类用户行为数据上传到Hadoop
大数据·hadoop·分布式·sql·scala
今天没有盐23 天前
Python字符串操作全解析:从基础定义到高级格式化
后端·scala·编程语言
是阿威啊24 天前
【用户行为归因分析项目】- 【企业级项目开发第一站】项目架构和需求设计
大数据·hive·hadoop·架构·spark·scala
代码于老总1 个月前
【Scala 技巧】用隐式类给 String “开挂”:一行代码实现手机号 / 身份证号校验
scala
scala舔狗汪1 个月前
scala的隐式对象和隐式类
scala
是阿威啊1 个月前
【maap-analysis】spark离线数仓项目完整的开发流程
大数据·分布式·spark·scala
豚踢兔x1 个月前
正则表达式应用-手机号打码
scala