【LeetCode】4. 去重的效率提升

看一道简单题

初始做法

python 复制代码
class Solution:
    def removeDuplicates(self, nums: List[int]) -> int:
        hashMap = []
        k = 0

        for i in nums:
            if i not in hashMap:
                hashMap.append(i)
                nums[k] = i
                k += 1
        
        nums[:] = nums[:k]
         
        return k

这个做法建立了一个数组用来存储重复值。

python 复制代码
if i not in hashMap

会导致多次遍历,猜测是这一段增加了内存消耗。

优化思路应该将遍历减少到最低

使用set优化

python 复制代码
class Solution:
    def removeDuplicates(self, nums: List[int]) -> int:
        seen = set()  # 用于记录已出现的元素
        k = 0  # 指向放置下一个唯一值的位置

        for i in nums:
            if i not in seen:
                seen.add(i)  # 将新元素添加到集合中
                nums[k] = i  # 将唯一值放到 nums 的前面
                k += 1

        # 保留前 k 个元素
        nums[:] = nums[:k]

        return k

注意set是基于 哈希表 实现的

set 比 list 效率高,尤其是在执行查找操作时,这是因为两者底层的实现机制不同。具体原因如下:

1. list 的实现

数据结构: list 是一种动态数组,元素按插入顺序连续存储。
查找操作:

当你执行 x in list,Python 必须从头开始遍历列表中的每个元素,逐一检查是否等于 x。

最坏情况下需要检查所有元素,时间复杂度为 O(n)。
适合的场景:

适用于需要保留元素顺序或频繁执行索引访问(listi,时间复杂度为 O(1)。

2. set 的实现

数据结构:

set 是基于 哈希表 的无序集合。

每个元素会通过哈希函数映射到一个特定的存储位置(桶)。

哈希表通过哈希值快速定位元素的位置,而无需遍历整个集合。

查找操作:

当你执行 x in set,Python 使用哈希函数计算 x 的哈希值,然后直接定位到对应的存储桶,查看是否存在。

在没有大量哈希冲突的情况下,查找的时间复杂度为 O(1)。

即使发生哈希冲突(两个不同的值映射到相同的桶),通过链表或其他冲突处理机制,效率仍然远高于线性查找。

适合的场景:

适用于频繁执行查找、插入、删除操作,且不需要关心元素顺序。

相关推荐
-dzk-1 分钟前
【动态规划】LC 416.分割等和子集
算法·动态规划·代理模式
夏幻灵21 分钟前
每日一题:LeetCode 1:两数之和——从暴力枚举到 Map 哈希表优化
算法·leetcode·散列表
段一凡-华北理工大学30 分钟前
高炉炼铁机器视觉与智能识别十八讲~系列文章09:AI 算法基础:从传统图像处理到深度学习的视觉“大脑“
图像处理·人工智能·算法·机器视觉·工业智能化·高炉炼铁智能化·高炉智能识别
alphaTao37 分钟前
LeetCode 每日一题 2026/9/28-2026/10/4
算法·leetcode
源码学社40 分钟前
图像去水印实测:OpenCV inpainting vs LaMa,传统算法和 AI 模型差距有多大
人工智能·opencv·算法·去水印·图片水印·ai去水印
一条大祥脚1 小时前
26ICPC网络赛第二场 计数|DFS|MEX|贪心
算法·深度优先·mex·icpc网络赛
aqiu1111111 小时前
【蓝桥杯 / C++】星际争霸 — 字符串逆序对与大整数自定义排序
算法
行者全栈架构师1 小时前
【鸿蒙心迹】ArkUI 列表性能实战——为什么 200 条数据页面掉到 20fps,LazyForEach 怎么救(HarmonyOS 7.x)
前端·算法·架构
一碗甜汤ᐝ1 小时前
高级算法分析与设计 | 常见 NP-Complete 问题总结
算法·np-complete·算法分析与设计·np完备问题
垆边人似月.2 小时前
分割数组的最大值最小化(200分 / 二分答案 + 贪心)
数据结构·算法·排序算法