互联网面试-MySQL 中的 distinct 和 group by 哪个效率更高?
wptr33 2024-11-09 15:00 34 浏览
在MySQL中我们最常用的去重方式有两种,分别是使用distinct,或者是使用group by进行去重操作,下面我们就来介绍一下这两者之间的区别与联系。
distinct的使用
单列去重
在MySQL中通常使用如下的语法来通过distinct进行单列去重。
SELECT DISTINCT columns FROM table_name WHERE where_conditions;
DISTINCT关键字主要是用来返回不同的值的,也就是说对于相同的值只会返回一个,并且作用于主语句所有列。如果在这个列中具有null的值,并且还对该列使用了distinct语句,那么MySQL只会保留一个null的值。
多列去重
distinct 对于多列的去重操作是根据指定的去重列的信息来进行操作,也就是说只有当所有的参与去重的列的值都相同的时候,才会认为是相同的信息,否则就是不一样的数据。
group by 去重
使用group by 去重语法如下。属于是对单列数据进行去重操作。
SELECT columns FROM table_name WHERE where_conditions GROUP BY columns;
group by多列去重语法如下。
SELECT columns FROM table_name WHERE where_conditions GROUP BY columns;
对于使用group by去重操作是将结果先进行分组排列,然后返回分组之后的第一条元素,并且根据group by 后面的字段进行去重。
distinct 和 group by的原理
在大多数的情况下,distinct可以被看做是一个特殊的group by操作,因为其去重的原理都是基于分组进行操作的,并且都可以通过索引扫描来完成。例如下面两条的语句来进行分析一下。
explain select int1_index from test_distinct_groupby group by int1_index;
explain select distinct int1_index from test_distinct_groupby;
其结果对应的extra都是 Using index for group-by。也就是说在语义相同的情况下二者的执行效率是一样的。
这里需要注意的是group by操作在MySQL8.0之前,会默认使用字段进行隐式的排序操作。也就是说在去重的同时还对去重字段进行了排序。而且这种隐式的排序在数据量超过一定大小的时候,会将临时数据拷贝到磁盘上进行操作,这样整个的SQL语句的执行效率会非常低。所以在MySQL8.0开始就放弃了这种隐式排序操作。
结论
在语相同的情况下,group by和distinct 都使用了索引,并且效率相同,在这种情况下两者几乎是等价的。
在语义相同,但没有索引的情况下,distinct的效率要高于group by,原因是distinct和group by都进行了分组操作,但是对于group by来讲,在MySQL8.0之前会进行隐式的排序,这样就会导致 filesort,这样就会导致SQL执行效率比较低。
但是从MySQL8.0开始,MySQL就删除了隐式的排序操作,所以在语义相同的情况,如果没有索引两者的效率是一样的。
为什么要推荐group by的使用呢?
因为相比较distinct来讲,group by更容易被理解,而且由于distinct会对所有的字段都生效,所以在进行一些复杂处理的时候,相比较于group by来说相对灵活。
相关推荐
- Linux文件系统操作常用命令(linux文件内容操作命令)
-
在Linux系统中,有一些常用的文件系统操作命令,以下是这些命令的介绍和作用:#切换目录,其中./代表当前目录,../代表上一级目录cd#查看当前目录里的文件和文件夹ls#...
- 别小看tail 命令,它难倒了技术总监
-
我把自己以往的文章汇总成为了Github,欢迎各位大佬star...
- lnav:基于 Linux 的高级控制台日志文件查看器
-
lnav是一款开源的控制台日志文件查看器,专为Linux和Unix-like系统设计。它通过自动检测日志文件的格式,提取时间戳、日志级别等关键信息,并将多个日志文件的内容按时间顺序合并显示,...
- 声明式与命令式代码(声明模式和命令模式)
-
编程范式中的术语和差异信不信由你,你可能已经以开发人员的身份使用了多种编程范例。因为没有什么比用编程理论招待朋友更有趣的了,所以这篇文章可以帮助您认识代码中的流行范例。命令式编程命令式编程是我们从As...
- linux中的常用命令(linux常用命令和作用)
-
linux中的常用命令linux中的命令统称shell命令shell是一个命令行解释器,将用户命令解析为操作系统所能理解的指令,实现用户与操作系统的交互shell终端:我们平时输入命令,执行程序的那个...
- 提高工作效率的--Linux常用命令,能够决解95%以上的问题
-
点击上方关注,第一时间接受干货转发,点赞,收藏,不如一次关注评论区第一条注意查看回复:Linux命令获取linux常用命令大全pdf+Linux命令行大全pdf...
- 如何限制他人操作自己的电脑?(如何控制别人的电脑不让发现)
-
这段时间,小猪罗志祥正处于风口浪尖,具体是为啥?还不知道的小伙伴赶紧去补一下最近的娱乐圈八卦~简单来说,就是我们的小罗同事,以自己超强的体力,以及超强的时间管理能力,重新定义了「多人运动」的含义,重新...
- 最通俗易懂的命令模式讲解(命令模式百科)
-
我们先不讲什么是命令模式,先通过一个场景来引出命令模式,看看命令模式能解决什么样的问题。现在有一个渣男张三,他有还几个女朋友,你现在是不是还是单身狗,你就说你气不气?然后他需要每天分别叫几个女朋友起床...
- 互联网大厂后端必看!Spring Boot 中Runtime执行与停止命令?
-
你是否曾在使用SpringBoot开发项目时,遇到需要执行系统命令的场景?比如调用脚本进行文件处理,又或是启动外部程序?很多后端开发人员会使用Processexec=Runtime.get...
- Linux 常用命令(linux常用的20个命令面试)
-
日志排查类操作命令...
- Java字节码指令:if_icmpgt(0xA3)(java字节码使用的汇编语言)
-
if_icmpgt是Java字节码中的一条条件跳转指令,其全称是"IfIntegerCompareGreaterThan"。它用于比较两个整数值的大小。如果栈顶的第一个...
- 外贸干货|如何增加领英的曝光量和询盘
-
#跨境电商#...
- golang执行linux命令(golang调用shell脚本)
-
需求需要通过openssl生成rsa秘钥,然后保存该秘钥。代码实例packagemainimport("io/ioutil""bytes"&...
- LINUX磁盘挂载(linux磁盘挂载到windows)
-
1、使用root用户查看磁盘挂载情况:fdisk-l2、使用df查看当前磁盘挂载情况,根据和fdisk-l的结果进行对比,查看还有那些磁盘未使用3、挂载:mount磁盘挂载路径...
- Linux命令学习——nl命令(linux ln命令的使用)
-
nl命令主要功能为每一个文件添加行号,每一个输入的文件添加行号后发送到标准输出。当没有文件或文件为-时,读取标准输入...
- 一周热门
-
-
C# 13 和 .NET 9 全知道 :13 使用 ASP.NET Core 构建网站 (1)
-
因果推断Matching方式实现代码 因果推断模型
-
git pull命令使用实例 git pull--rebase
-
面试官:git pull是哪两个指令的组合?
-
git 执行pull错误如何撤销 git pull fail
-
git fetch 和git pull 的异同 git中fetch和pull的区别
-
git pull 和git fetch 命令分别有什么作用?二者有什么区别?
-
git pull 之后本地代码被覆盖 解决方案
-
还可以这样玩?Git基本原理及各种骚操作,涨知识了
-
git命令之pull git.pull
-
- 最近发表
- 标签列表
-
- git pull (33)
- git fetch (35)
- mysql insert (35)
- mysql distinct (37)
- concat_ws (36)
- java continue (36)
- jenkins官网 (37)
- mysql 子查询 (37)
- python元组 (33)
- mybatis 分页 (35)
- vba split (37)
- redis watch (34)
- python list sort (37)
- nvarchar2 (34)
- mysql not null (36)
- hmset (35)
- python telnet (35)
- python readlines() 方法 (36)
- munmap (35)
- docker network create (35)
- redis 集合 (37)
- python sftp (37)
- setpriority (34)
- c语言 switch (34)
- git commit (34)