对于Oracle,MySQL,SQL Server重复数据删除

问题前提

之前做过数据入湖,建表的时候匆忙,没有做主键,导致入湖出现了重复数据。举个例子:

|----|------|-----|-----|
| id | name | age | sex |
| 1 | 用户1 | 21 | 男 |
| 1 | 用户1 | 21 | 男 |
| 1 | 用户1 | 21 | 男 |

存在了如上两条及两条数据,目的是要去除重复数据,只保留一条,从而设置id为主键。

Oracle

Oracle如果存在重复数据,id设置主键时,会有02437报错。

对于Oracle去处重复数据是最简单的,每行自带rowid。

sql 复制代码
DELETE 
FROM
	user 
WHERE
	id IN ( SELECT id FROM user GROUP BY id HAVING count( id ) > 1 ) 
	AND rowid NOT IN (
	SELECT
		min( rowid ) 
	FROM
		user  
	GROUP BY
		id 
HAVING
	count( id )> 1)

执行如上语句即可删除重复数据。

因为本地没有Oracle数据库,就不做演示了。

MySQL

MySQL没有rowid,那么MySQL解决办法只有一种,把A表的数据去重添加到B表中,在B表中设置id为主键,最后把B表重命名为A表。

sql 复制代码
INSERT INTO user1 ( SELECT DISTINCT * FROM user );

暂不清楚,数据量大的情况下会不会出现崩溃,可以通过limit截取。

如果不确定A表的数据是否全部添加到B表,可以添加完成后,执行

sql 复制代码
DELETE FROM user WHERE user.id IN (SELECT user1.id FROM user1)

这种方式当然也适用于其他数据库。

当然MySQL还有另外一种方式,就是新增一个字段为自增字段且不为null,让其自动填充,类似充当Orcal中的rowid。

填充完成后。

sql 复制代码
DELETE 
FROM
	user 
WHERE
	user.rowid NOT IN (
	  SELECT
		dt.minid 
	  FROM
	  ( SELECT MIN( user.rowid ) AS minid FROM user GROUP BY name ) dt 
	)

有多种方式,可参考【mysql】mysql删除重复记录并且只保留一条_mysql删除完全重复数据只保留一条_千g的博客-CSDN博客

SQL Server

SQL Server 和MySQL逻辑是一样的,但语法上稍有变化

sql 复制代码
SELECT DISTINCT * INTO [dbo].[user1] FROM [dbo].[user]

SQL Server是不需要创建user1表的,会自动创建,数据导入到新表后再设置主键即可。

另外一种设置自增rowid,执行:

sql 复制代码
DELETE 
FROM
	[dbo].[user] 
WHERE
	[dbo].[user].rowid NOT IN (
	  SELECT
		dt.minid 
	  FROM
	  ( SELECT MIN( [dbo].[user].rowid ) AS minid FROM [dbo].[user] GROUP BY name ) dt 
	)

后续

后续研究其他数据库,mongo等其他用到的数据库再做更新,

相关推荐
江畔柳前堤22 分钟前
PyQt学习系列07-数据库操作与ORM集成
数据库·学习·算法·机器学习·架构·pyqt
观无44 分钟前
腾讯云Mysql实现远程链接
数据库·mysql
SmartSoftHelp开发辅助优化1 小时前
SmartSoftHelp 之 SQL Server 数据库安全备份与安全还原详解---深度优化版:SmartSoftHelp DeepCore XSuite
数据库·安全·oracle
朝新_2 小时前
【MySQL】第九弹——索引(下)
数据库·mysql
数据要素X2 小时前
【数据架构03】数据治理架构篇
大数据·数据库·数据仓库·架构
不思念一个荒废的名字2 小时前
【黑马JavaWeb+AI知识梳理】后端Web基础03 - MySQL概述
前端·数据库·mysql
北极光SD-WAN组网2 小时前
SD-WAN技术在远程光伏电站接入场景中的应用实践与深度解析
服务器·网络·数据库
朱友斌3 小时前
【软件安装】Windows操作系统中安装mongodb数据库和mongo-shell工具
数据库·mongodb·安装mongodb数据库·安装mongodb-shell
Le_ee3 小时前
sqli-labs第十四关——“POST报错注入
数据库·sql·mysql
炸毛的飞鼠3 小时前
智警杯备赛--数据应用技术1
数据库