登录
推荐 文章 Go 技术 课程 下载 专题 AI
首页 >  数据库 >  MySQL

MySQL UNION 和 UNION ALL 什么时候需要去重

来源:17golang原创

时间:2026-09-06 11:00:00 290浏览 收藏

MySQL 合并多个 SELECT 结果时,是否去重取决于业务语义:同一条记录从两个来源出现,只想保留一份,用 UNION;每次出现都代表一条需要统计的来源记录,用 UNION ALL。不要把“结果看起来重复”直接等同于数据错误。

一句话判断:名单、可见范围这类集合通常用 UNION;日志、订单明细、分来源计数这类集合通常用 UNION ALL。MySQL 默认的 UNION 就会删除重复整行,UNION ALL 才会保留重复行。
要点速览
  • 去重比较的是合并结果中的整行值,不是只看某个 id。
  • 各查询块的列按位置对应,结果列名取第一个查询块。
  • 分支 LIMIT 放在括号内;整个结果的 ORDER BYLIMIT 放在末尾。

先判断重复行是不是业务重复

假设后台要把“直营门店会员”和“加盟门店会员”合成一个可触达名单。一个手机号同时出现在两张表,发一次短信即可,这时重复行没有额外业务价值:

-- 两个查询返回相同的列结构,重复的整行只保留一份
SELECT member_id, mobile FROM direct_member
UNION
SELECT member_id, mobile FROM franchise_member;

如果场景是合并两张操作日志,直营和加盟各产生一条记录,即使字段值恰好相同,也要保留两次,便于统计来源次数,此时应写成:

-- 每个来源的记录都要计入,不能让集合运算替你删行
SELECT user_id, action, created_at FROM direct_log
UNION ALL
SELECT user_id, action, created_at FROM franchise_log;

选择表可以快速作判断:

需求推荐写法原因
多个来源合成唯一名单UNION相同整行只需要一次
日志、订单、事件明细汇总UNION ALL每行出现次数有业务含义
明确希望去重UNION DISTINCTUNION显式表达集合语义
MySQL UNION 与 UNION ALL 处理两个查询块中重复整行的静态关系图
图1:同一整行来自两个查询块时,UNION 删除重复行,UNION ALL 保留来源次数。

用列位置和整行值理解 UNION 结果

UNION 不是按主键自动去重,而是比较合并后每一行的整体值。例如下面两行的 id 相同,但 source 不同,它们并不是相同整行:

-- id 相同但 source 不同,UNION 仍会保留两行
SELECT 7 AS id, 'web' AS source
UNION
SELECT 7 AS id, 'app' AS source;

反过来,如果希望“按会员 id 只留一条”,就不能只把 UNION 当成去重工具。应先用 UNION ALL 保留来源,再在外层按业务规则选择,例如按最新时间取一条。这样“按哪一列去重、冲突时留哪一条”才是可见的。

列的对应关系按位置而不是别名:第一个查询的第一列对应第二个查询的第一列。结果列名也取第一个查询块,因此建议两边显式写出相同顺序和兼容类型的字段,别依赖 SELECT *

-- 第一列决定结果列名;两边用相同位置表达同一业务字段
SELECT member_id AS id, mobile AS contact FROM direct_member
UNION ALL
SELECT member_id, mobile FROM franchise_member;

把 ORDER BY、LIMIT 放在正确边界

合并表达式默认不承诺最终行顺序。要限制某一个来源,给该查询块加括号;要限制合并后的总结果,把排序和限制写在最后:

-- 括号内的 LIMIT 只限制直营来源
(SELECT member_id, created_at FROM direct_member
 ORDER BY created_at DESC LIMIT 100)
UNION ALL
SELECT member_id, created_at FROM franchise_member
-- 这里的 ORDER BY 与 LIMIT 作用于整个 UNION ALL 结果
ORDER BY created_at DESC LIMIT 100;

有一个容易忽略的边界:单个查询块只有 ORDER BY、没有 LIMIT 时,通常不能改变最终集合的显示顺序;最终顺序仍应由末尾的 ORDER BY 决定。末尾排序引用的列名要使用第一个查询块提供的列名或别名,不能写后一个表的限定名。

MySQL UNION 查询块列位置与分支 LIMIT、最终 ORDER BY LIMIT 作用范围关系图
图2:分支 LIMIT 需要包住对应查询块,整个 UNION 的 ORDER BY 与 LIMIT 位于集合表达式末端。

用业务字段决定最终写法

在代码评审中,可以按四个问题收尾:第一,重复整行是否代表同一业务对象;第二,是否需要保留来源和出现次数;第三,两边字段是否按相同位置排列;第四,排序和分页是在单个来源内做,还是对合并结果做。

如果答案是“按会员集合去重”,使用 UNION;如果答案是“保留每条日志再汇总”,使用 UNION ALL。需要按 id 合并但保留最新记录时,先 UNION ALL,再在外层使用窗口函数或聚合规则,不要期待 UNION 替你解决冲突。

事实边界可直接查看 MySQL 8.4 集合操作文档:它说明默认去除重复行、ALL 保留重复行,以及各查询块的列和排序限制。

相关问题

UNION 会按主键或 id 去重吗?

不会。它按合并结果的整行值判断重复;同一 id 的其他字段不同,仍可能保留多行。

UNION ALL 一定比 UNION 快吗?

它不需要承担同样的重复行消除语义,通常更适合明细合并,但最终耗时仍取决于数据量、磁盘和外层排序,不能只凭关键字下结论。

两个查询的列名不同可以 UNION 吗?

可以,列名按位置匹配,结果列名取第一个查询块;但对应位置应表达兼容的数据类型。

为什么分支 ORDER BY 没有让最终结果有序?

分支排序只在该查询块内部有意义,集合合并后的结果默认无序;需要稳定展示时,在最后统一写 ORDER BY

声明:本文转载于:17golang原创 如有侵犯,请联系study_golang@163.com删除
相关阅读
更多>
最新阅读
更多>
课程推荐
更多>