加入收藏 | 设为首页 | 会员中心 | 我要投稿 好传媒网 (https://www.haochuanmei.com/)- 科技、建站、经验、云计算、5G、大数据,站长网!
当前位置: 首页 > 站长学院 > MySql教程 > 正文

数据库根据指定字段去重的案例解析

发布时间:2022-02-21 14:36:08 所属栏目:MySql教程 来源:互联网
导读:这篇文章主要介绍了数据库根据指定字段去重的案例分析,具有一定借鉴价值,需要的朋友可以参考下。希望大家阅读完这篇文章后大有收获。下面让小编带着大家一起了解一下。 需求:对一张用户表根据name/email/card_num字段去除重复数据; 思路:用group by方法
       这篇文章主要介绍了数据库根据指定字段去重的案例分析,具有一定借鉴价值,需要的朋友可以参考下。希望大家阅读完这篇文章后大有收获。下面让小编带着大家一起了解一下。
 
       需求:对一张用户表根据name/email/card_num字段去除重复数据;
 
      思路:用group by方法可以查询出'去重'后的数据,将这些数据存储到一张临时表中,然后将临时表的数据存储到指定的表中;
 
     误区及解决方案:group by方法只能获取部分字段(去重指定字段),不能一次获取到完整的数据,但是可以通过max函数获取group by结果集中的id,再根据id集合查询出全部的记录。
 
测试思路
查询去重后的数据
SELECT max(id) as id,name,email,card_num FROM users GROUP BY name,email,card_num;
 
从去重后的数据中获取id集合
SELECT ID from (SELECT max(id) as id,name,email,card_num FROM users  GROUP BY name,email,card_num) as T;
 
根据去重后的数据中获取id集合,从源数据中获得记录列表
SELECT * from users  where id in (SELECT ID from (SELECT max(id) as id,name,email,card_num FROM users GROUP BY name,email,card_num) as T);
 
实际方法
根据去重后的数据中获取id集合,从源数据中获得记录列表,将这些列表数据存入一个临时表中
create TEMP TABLE tmp_data as SELECT * from users where id in (SELECT ID from (SELECT max(id) as id,name,email,card_num FROM users GROUP BY name,email,card_num) as T);
 
将临时表中的数据存入指定的数据表中,完毕
insert into users_copy1 select * from tmp_data;
 
检测
检测结果是不是和第一步查询去重后的数据总数相同
select count(*) from users_copy1;
 
测试结果:1.4w条数据中有2300条数据重复,实际运行结果为0.7s,基本满足现在的需求。
 
感谢你能够认真阅读完这篇文章,希望小编分享数据库根据指定字段去重的案例分析内容对大家有帮助。

(编辑:好传媒网)

【声明】本站内容均来自网络,其相关言论仅代表作者个人观点,不代表本站立场。若无意侵犯到您的权利,请及时与联系站长删除相关内容!

    热点阅读