MySQL去重該使用distinct還是group by？

更新時(shí)間：2020年05月13日 10:53:03 作者：澤陽君

這篇文章主要介紹了MySQL去重該使用distinct還是group by,本文通過實(shí)例代碼給大家介紹的非常詳細(xì)，對大家的學(xué)習(xí)或工作具有一定的參考借鑒價(jià)值，需要的朋友可以參考下

前言

關(guān)于group by 與distinct 性能對比:網(wǎng)上結(jié)論如下，不走索引少量數(shù)據(jù)distinct性能更好，大數(shù)據(jù)量group by 性能好，走索引group by性能好。走索引時(shí)分組種類少distinct快。關(guān)于網(wǎng)上的結(jié)論做一次驗(yàn)證。

準(zhǔn)備階段屏蔽查詢緩存

查看MySQL中是否設(shè)置了查詢緩存。為了不影響測試結(jié)果，需要關(guān)閉查詢緩存。

show variables like '%query_cache%';

在這里插入圖片描述

查看是否開啟查詢緩存決定于query_cache_type和query_cache_size。

方法一：關(guān)閉查詢緩存需要找到my.ini，修改query_cache_type需要修改C:\ProgramData\MySQL\MySQL Server 5.7\my.ini配置文件，修改query_cache_type=0或2。
方法二：設(shè)置query_cache_size為0，執(zhí)行以下語句。

set global query_cache_size = 0;

方法三：如果你不想關(guān)閉查詢緩存，也可以在使用RESET QUERY CACHE。

現(xiàn)在測試環(huán)境中query_cache_type=2代表按需進(jìn)行查詢緩存，默認(rèn)的查詢方式是不會(huì)進(jìn)行緩存，如需緩存則需要在查詢語句中加上sql_cache。

數(shù)據(jù)準(zhǔn)備

t0表存放10W少量種類少的數(shù)據(jù)

drop table if exists t0;
create table t0(
id bigint primary key auto_increment,
a varchar(255) not null
) engine=InnoDB default charset=utf8mb4 collate=utf8mb4_bin;
1
2
3
4
5
drop procedure insert_t0_simple_category_data_sp;
delimiter //
create procedure insert_t0_simple_category_data_sp(IN num int)
begin
set @i = 0;
while @i < num do
	insert into t0(a) value(truncate(@i/1000, 0));
 set @i = @i + 1;
end while;
end
//
call insert_t0_simple_category_data_sp(100000);

t1表存放1W少量種類多的數(shù)據(jù)

drop table if exists t1;
create table t1 like t0;
1
2
drop procedure insert_t1_complex_category_data_sp;
delimiter //
create procedure insert_t1_complex_category_data_sp(IN num int)
begin
set @i = 0;
while @i < num do
	insert into t1(a) value(truncate(@i/10, 0));
 set @i = @i + 1;
end while;
end
//
call insert_t1_complex_category_data_sp(10000);

t2表存放500W大量種類多的數(shù)據(jù)

drop table if exists t2;
create table t2 like t1;
1
2
drop procedure insert_t2_complex_category_data_sp;
delimiter //
create procedure insert_t2_complex_category_data_sp(IN num int)
begin
set @i = 0;
while @i < num do
	insert into t1(a) value(truncate(@i/10, 0));
 set @i = @i + 1;
end while;
end
//
call insert_t2_complex_category_data_sp(5000000);

測試階段

驗(yàn)證少量種類少數(shù)據(jù)

未加索引

set profiling = 1;
select distinct a from t0;
show profiles;
select a from t0 group by a;
show profiles;
alter table t0 add index `a_t0_index`(a);

在這里插入圖片描述

由此可見：少量種類少數(shù)據(jù)下，未加索引，distinct和group by性能相差無幾。

加索引

alter table t0 add index `a_t0_index`(a);

執(zhí)行上述類似查詢后

在這里插入圖片描述

由此可見：少量種類少數(shù)據(jù)下，加索引，distinct和group by性能相差無幾。

驗(yàn)證少量種類多數(shù)據(jù)未加索引

執(zhí)行上述類似未加索引查詢后

在這里插入圖片描述

由此可見：少量種類多數(shù)據(jù)下，未加索引，distinct比group by性能略高，差距并不大。

加索引

alter table t1 add index `a_t1_index`(a);

執(zhí)行類似未加索引查詢后

在這里插入圖片描述

由此可見：少量種類多數(shù)據(jù)下，加索引，distinct和group by性能相差無幾。

驗(yàn)證大量種類多數(shù)據(jù)

未加索引

SELECT count(1) FROM t2;

在這里插入圖片描述

執(zhí)行上述類似未加索引查詢后

在這里插入圖片描述

由此可見：大量種類多數(shù)據(jù)下，未加索引，distinct比group by性能高。

加索引

alter table t2 add index `a_t2_index`(a);

執(zhí)行上述類似加索引查詢后

在這里插入圖片描述

由此可見：大量種類多數(shù)據(jù)下，加索引，distinct和group by性能相差無幾。

總結(jié) 性能比少量種類少少量種類多大量種類多未加索引相差無幾distinct略優(yōu)distinct更優(yōu)加索引相差無幾相差無幾相差無幾

去重場景下，未加索引時(shí)，更偏向于使用distinct，而加索引時(shí)，distinct和group by兩者都可以使用。

總結(jié)

到此這篇關(guān)于MySQL去重該使用distinct還是group by？的文章就介紹到這了,更多相關(guān)mysql 去重distinct group by內(nèi)容請搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關(guān)文章希望大家以后多多支持腳本之家！

您可能感興趣的文章:

相關(guān)文章

MySQL處理JSON常見函數(shù)的使用
這篇文章主要介紹了MySQL處理JSON常見函數(shù)的使用，文中通過示例代碼介紹的非常詳細(xì)，對大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價(jià)值，需要的朋友們下面隨著小編來一起學(xué)習(xí)學(xué)習(xí)吧
2021-03-03
MySQL存儲(chǔ)過程的創(chuàng)建使用以及實(shí)現(xiàn)數(shù)據(jù)快速插入
因最近想要測試一下MySQL百萬級數(shù)據(jù)處理過程,所以要一次對數(shù)據(jù)庫快速插入大量數(shù)據(jù),下面這篇文章主要給大家介紹了關(guān)于MySQL存儲(chǔ)過程的創(chuàng)建使用以及實(shí)現(xiàn)數(shù)據(jù)快速插入的相關(guān)資料,需要的朋友可以參考下
2023-03-03
MySQL制作具有千萬條測試數(shù)據(jù)的測試庫的方法
這篇文章主要介紹了MySQL制作具有千萬條測試數(shù)據(jù)的測試庫的方法，幫助大家更好的理解和學(xué)習(xí)MySQL，感興趣的朋友可以了解下
2020-11-11
MySQL詳細(xì)匯總常用函數(shù)
MySQL數(shù)據(jù)庫中提供了很豐富的函數(shù)。MySQL函數(shù)包括數(shù)學(xué)函數(shù)、字符串函數(shù)、日期和時(shí)間函數(shù)、條件判斷函數(shù)、系統(tǒng)信息函數(shù)、加密函數(shù)、格式化函數(shù)等。通過這些函數(shù)，可以簡化用戶的操作。本期將帶你總結(jié)常用函數(shù)都有哪些
2021-11-11
mysql實(shí)現(xiàn)遞歸查詢的方法示例
本文主要介紹了mysql實(shí)現(xiàn)遞歸查詢的方法示例，文中通過示例代碼介紹的非常詳細(xì)，對大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價(jià)值，需要的朋友們下面隨著小編來一起學(xué)習(xí)學(xué)習(xí)吧
2023-07-07
由于程序員寫的東西不一定是最優(yōu)的所以我們只要啟用mysql慢查詢?nèi)罩竟δ芫涂梢苑治雒恳粭lsql語句所運(yùn)行相關(guān)性能了，下面大家一起來看看
2017-01-01

優(yōu)化MySQL Join算法的性能的操作方法

本文介紹了優(yōu)化MySQL JOIN算法性能的多種方法,包括索引優(yōu)化、表結(jié)構(gòu)設(shè)計(jì)、查詢語句優(yōu)化和系統(tǒng)配置調(diào)整,通過合理創(chuàng)建索引、優(yōu)化表結(jié)構(gòu)、選擇合適的驅(qū)動(dòng)表以及調(diào)整相關(guān)系統(tǒng)參數(shù),可以有效提高JOIN操作的性能,感興趣的朋友一起看看吧

2025-02-02

解析遠(yuǎn)程連接管理其他機(jī)器上的MYSQL數(shù)據(jù)庫

本篇文章是對遠(yuǎn)程連接管理其他機(jī)器上的MYSQL數(shù)據(jù)庫進(jìn)行了詳細(xì)的分析介紹，需要的朋友參考下

2013-06-06

mysql數(shù)據(jù)庫基本語法及操作大全

這篇文章主要介紹了mysql數(shù)據(jù)庫基本語法及操作大全,本文給大家介紹的非常詳細(xì)，對大家的學(xué)習(xí)或工作具有一定的參考借鑒價(jià)值，需要的朋友可以參考下

2021-04-04

MySql修改數(shù)據(jù)庫編碼為UTF8避免造成亂碼問題

mysql 創(chuàng)建數(shù)據(jù)庫時(shí)指定編碼很重要，很多開發(fā)者都使用了默認(rèn)編碼，亂碼問題可是防不勝防，下面與大家分享下通過修改數(shù)據(jù)庫默認(rèn)編碼方式為UTF8來減少數(shù)據(jù)庫創(chuàng)建時(shí)的設(shè)置,避免因粗心造成的亂碼問題

2013-06-06

国产无遮挡裸体免费直播视频,久久精品国产蜜臀av,动漫在线视频一区二区,欧亚日韩一区二区三区,久艹在线免费视频,国产精品美女网站免费,正在播放 97超级视频在线观看,斗破苍穹年番在线观看免费,51最新乱码中文字幕

MySQL去重該使用distinct還是group by？

相關(guān)文章

最新評論

大家感興趣的內(nèi)容

最近更新的內(nèi)容

常用在線小工具

国产无遮挡裸体免费直播视频,久久精品国产蜜臀av,动漫在线视频一区二区,欧亚日韩一区二区三区,久艹在线 免费视频,国产精品美女网站免费,正在播放 97超级视频在线观看,斗破苍穹年番在线观看免费,51最新乱码中文字幕

MySQL去重該使用distinct還是group by？

相關(guān)文章

最新評論

大家感興趣的內(nèi)容

最近更新的內(nèi)容

常用在線小工具

国产无遮挡裸体免费直播视频,久久精品国产蜜臀av,动漫在线视频一区二区,欧亚日韩一区二区三区,久艹在线免费视频,国产精品美女网站免费,正在播放 97超级视频在线观看,斗破苍穹年番在线观看免费,51最新乱码中文字幕

MySQL去重該使用distinct還是group by？