sql语句如何去重复记录?教你两个办法
发布时间:2022-03-03 16:50:37 所属栏目:MsSql教程 来源:互联网
导读:sql语句如何去重复记录?我们在存储数据的时候,会存在一些重复字段,那么我们如何高效去除重复记录呢?下面给大家分享两种实现方法,感兴趣的朋友可以参考参考。 如果要删除手机(mobilePhone),电话(officePhone),邮件(email)同时都相同的数据,以前一直使
|
sql语句如何去重复记录?我们在存储数据的时候,会存在一些重复字段,那么我们如何高效去除重复记录呢?下面给大家分享两种实现方法,感兴趣的朋友可以参考参考。 如果要删除手机(mobilePhone),电话(officePhone),邮件(email)同时都相同的数据,以前一直使用这条语句进行去重: delete from 表 where id not in (select max(id) from 表 group by mobilePhone,officePhone,email ) or delete from 表 where id not in (select min(id) from 表 group by mobilePhone,officePhone,email ) delete from 表 where id not in (select max(id) from 表 group by mobilePhone,officePhone,email ) or delete from 表 where id not in (select min(id) from 表 group by mobilePhone,officePhone,email ) 用临时表插入对500万数据去重(1/2重复)不到10分钟。 其实用删除方式是比较慢的,可能是边找边删除的原因吧,而使用临时表,可以将没有重复的数据ID选出来放在临时表里,再将表的信息按临时表的选择出来的ID,将它们找出来插入到新的表,然后将原表删除,这样就可以快速去重啦。 方法一按照多条件重复处理: delete tmp from( select row_num = row_number() over(partition by 字段,字段 order by 时间 desc) from 表 where 时间> getdate()-1 ) tmp where row_num > 1 delete tmp from( select row_num = row_number() over(partition by 字段,字段 order by 时间 desc) from 表 where 时间> getdate()-1 ) tmp where row_num > 1 方法二按照单一条件进行去重: delete from 表 where 主键ID not in( select max(主键ID) from 表 group by 需要去重的字段 having count(需要去重的字段)>=1 ) delete from 表 where 主键ID not in( select max(主键ID) from 表 group by 需要去重的字段 having count(需要去重的字段)>=1 ) 注意:为提高效率如上两个方法都可以使用临时表, not in 中的表可以先提取临时表#tmp, 然后采用not exists来执行,为避免数量过大,可批量用Top控制删除量 delete top(2) from 表 where not exists (select 主键ID from #tmp where #tmp.主键ID=表.主键ID) ![]() (编辑:天瑞地安资讯网_保定站长网) 【声明】本站内容均来自网络,其相关言论仅代表作者个人观点,不代表本站立场。若无意侵犯到您的权利,请及时与联系站长删除相关内容! |
相关内容
- sql-server – 我应该在完整备份期间停止事务日志备份吗?
- 在SQL Server中将数据类型Varchar更改为Varbinary(max)
- sql-server – SQL默认实例名称
- sql-server – 从SQL Server事务日志文件中恢复已删除的行
- sql – 通过重复属性进行分组
- sql-server – 添加通配符(或顶部)时SQL Server查询的大幅减
- sql-server – 将每日时间表分组为[开始日期;结束日期]与工
- sql – 为索引列表生成CREATE脚本
- 数据库设计 – 数据库规范化是否已经死亡?
- sql-server – 在Excel中的VBA中从SQL Server捕获错误消息
站长推荐
热点阅读


