mysql数据库,如何处理重复的数据?
来源:SegmentFault
时间:2023-01-14 17:13:01 488浏览 收藏
来到golang学习网的大家,相信都是编程学习爱好者,希望在这里学习数据库相关编程知识。下面本篇文章就来带大家聊聊《mysql数据库,如何处理重复的数据?》,介绍一下MySQL、Java、后端,希望对大家的知识积累有所帮助,助力实战开发!
问题
在我们的mysql数据库中,经常会出现一些重复的数据,有些情况我们允许重复数据的存在,但有时候我们也需要删除这些重复的数据。我们如何去处理呢?
方法一:防止出现重复数据
也就是说我们再设计表的时候,就应该对这些数据设置一个UNIQUE 索引,在插入的时候就可以保证其唯一性,也就不存在有重复的数据了。当然你也可以直接设置为PRIMARY KEY(主键)。效果也是一样的。
我们看一个案例:下表中无索引及主键,所以该表允许出现多条重复记录。
CREATE TABLE student ( first_name CHAR(20), last_name CHAR(20), sex CHAR(10) );
目前first_name,last_name是可以重复的,如果不想重复这里有两个解决办法:
1、设置双主键模式
CREATE TABLE student ( first_name CHAR(20) NOT NULL, last_name CHAR(20) NOT NULL, sex CHAR(10), PRIMARY KEY (last_name, first_name) );
现在就无法插入重复数据了。
2、添加unique索引
CREATE TABLE student ( first_name CHAR(20) NOT NULL, last_name CHAR(20) NOT NULL, sex CHAR(10) UNIQUE (last_name, first_name) );
这两种看起来形式好像有一点区别,但是能起到相同的作用。此时我们可以插入两条重复的数据,会发现报错。
当然我们还可以在数据库中去验证一下:
SELECT COUNT(*) as repetitions, last_name, first_name FROM student GROUP BY last_name, first_name HAVING repetitions > 1;
在这里我们统计的是 first_name 和 last_name的重复记录数,上面已经用两种方法设置了,这里肯定就是0了。
方法二:在插入时指定能否插入重复数据
在这里我们使用的是Insert ignore into 与Insert into指令。
(1)Insert ignore into会忽略数据库中已经存在的数据,如果数据库没有数据,就插入新的数据,如果有数据的话就跳过这条数据。这样就可以保留数据库中已经存在数据,达到在间隙中插入数据的目的。
(2)Insert into则直接相反,会直接插入数据,不管数据库里面是否含有重复数据。
我们还是举例说明:
insert ignore into student (last_name, first_name) values ( '张三', '李四'); //结果 Query OK, 1 rows affected (0.00 sec) insert ignore into student (last_name, first_name) values ( '张三', '李四'); //结果 Query OK, 0 rows affected (0.00 sec)
现在我们看出来了吧,也就是说在执行第一条插入操作的时候,看到数据库没有,则直接插入一条新纪录,因此一行记录受到影响,但是在第二次插入的时候,数据库已经有一条一样的了,因此便不会插入了,0行受到影响。
当然了还有一个指令也可以完成类似于insert ignore into相似的功能,那就是replace into。他表示的是如果存在primary 或 unique相同的记录,则先删除掉。再插入新记录。
方法三:过滤重复数据
如果你需要读取不重复的数据可以在 SELECT 语句中使用 DISTINCT 关键字来过滤重复数据。
SELECT DISTINCT last_name, first_name FROM student ORDER BY last_name; 你也可以使用 GROUP BY 来读取数据表中不重复的数据: SELECT last_name, first_name FROM student GROUP BY (last_name, first_name);
方法四:删除重复数据
这种情况其实就相当于,在水的终点处去解决。看下面sql语句:
//根据student创建一个临时表,并使用group by过滤了重复数据 CREATE TABLE tmp SELECT last_name, first_name, sex FROM student; GROUP BY (last_name, first_name); //删除原student表 DROP TABLE student; //给这个临时表重新命名 ALTER TABLE tmp RENAME TO stu;
当然你也可以在数据表中添加 INDEX(索引) 和 PRIMAY KEY(主键)这种简单的方法来删除表中的重复记录。方法如下:
ALTER IGNORE TABLE student ADD PRIMARY KEY (last_name, first_name);
OK,解决办法这么多,相信能解决你的问题。
文中关于mysql的知识介绍,希望对你的学习有所帮助!若是受益匪浅,那就动动鼠标收藏这篇《mysql数据库,如何处理重复的数据?》文章吧,也可关注golang学习网公众号了解相关技术文章。
-
499 收藏
-
244 收藏
-
235 收藏
-
157 收藏
-
101 收藏
-
418 收藏
-
339 收藏
-
279 收藏
-
189 收藏
-
208 收藏
-
174 收藏
-
- 前端进阶之JavaScript设计模式
- 设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
- 立即学习 542次学习
-
- GO语言核心编程课程
- 本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
- 立即学习 507次学习
-
- 简单聊聊mysql8与网络通信
- 如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
- 立即学习 497次学习
-
- JavaScript正则表达式基础与实战
- 在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
- 立即学习 487次学习
-
- 从零制作响应式网站—Grid布局
- 本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
- 立即学习 484次学习
-
- 单薄的睫毛
- 很详细,收藏了,感谢师傅的这篇技术文章,我会继续支持!
- 2023-04-06 12:42:37
-
- 疯狂的草莓
- 赞 👍👍,一直没懂这个问题,但其实工作中常常有遇到...不过今天到这,帮助很大,总算是懂了,感谢博主分享博文!
- 2023-03-28 01:09:57
-
- 如意的面包
- 这篇技术贴真及时,细节满满,真优秀,码住,关注师傅了!希望师傅能多写数据库相关的文章。
- 2023-03-17 03:24:22
-
- 隐形的小虾米
- 这篇博文真及时,楼主加油!
- 2023-03-13 16:08:53
-
- 唠叨的河马
- 很有用,一直没懂这个问题,但其实工作中常常有遇到...不过今天到这,帮助很大,总算是懂了,感谢up主分享技术贴!
- 2023-01-22 09:56:01
-
- 欣慰的鼠标
- 这篇博文出现的刚刚好,太详细了,很有用,已加入收藏夹了,关注作者了!希望作者能多写数据库相关的文章。
- 2023-01-21 20:04:17