MySQL實(shí)現(xiàn)模糊查詢的高效方法總結(jié)(附30條優(yōu)化建議)
在使用msyql進(jìn)行模糊查詢的時(shí)候,很自然的會(huì)用到like語(yǔ)句,通常情況下,在數(shù)據(jù)量小的時(shí)候,不容易看出查詢的效率,但在數(shù)據(jù)量達(dá)到百萬(wàn)級(jí),千萬(wàn)級(jí)的時(shí)候,查詢的效率就很容易顯現(xiàn)出來(lái)。這個(gè)時(shí)候查詢的效率就顯得很重要!
一般情況下like模糊查詢的寫(xiě)法為(field已建立索引):
SELECT `column` FROM `table` WHERE `field` like '%keyword%';
上面的語(yǔ)句用explain解釋來(lái)看,SQL語(yǔ)句并未用到索引,而且是全表搜索,如果在數(shù)據(jù)量超大的時(shí)候,可想而知最后的效率會(huì)是這樣
對(duì)比下面的寫(xiě)法:
SELECT `column` FROM `table` WHERE `field` like 'keyword%';
這樣的寫(xiě)法用explain解釋看到,SQL語(yǔ)句使用了索引,搜索的效率大大的提高了!
但是有的時(shí)候,我們?cè)谧瞿:樵兊臅r(shí)候,并非要想查詢的關(guān)鍵詞都在開(kāi)頭,所以如果不是特別的要求,"keywork%
"并不合適所有的模糊查詢
這個(gè)時(shí)候阿里巴巴就問(wèn)到了我,如何解決上面的這個(gè)問(wèn)題?
我們可以使用下面的方法:
1.LOCATE(substr,str), LOCATE(substr,str,pos)
第一個(gè)語(yǔ)法返回substr在字符串str 的第一個(gè)出現(xiàn)的位置。第二個(gè)語(yǔ)法返回子符串 substr 在字符串str,從pos處開(kāi)始的第一次出現(xiàn)的位置。如果substr 不在str 中,則返回值為0 。
SELECT LOCATE('xbar',`foobar`); ###返回0 SELECT LOCATE('bar',`foobarbar`); ###返回4 SELECT LOCATE('bar',`foobarbar`,5); ###返回
SELECT `column` FROM `table` WHERE LOCATE('keyword', `field`)>0
備注:keyword是要搜索的內(nèi)容,field為被匹配的字段,查詢出所有存在keyword的數(shù)據(jù)
2.POSITION('substr' IN 'field')方法
position可以看做是locate的別名,功能跟locate一樣
SELECT `column` FROM `table` WHERE POSITION('keyword' IN `filed`)
3.INSTR('str','substr')方法
SELECT `column` FROM `table` WHERE INSTR(`field`, 'keyword' )>0
除了上述的方法外,還有一個(gè)函數(shù)FIND_IN_SET
FIND_IN_SET(str1,str2):
返回str2中str1所在的位置索引,其中str2必須以","分割開(kāi)。
使用like,還是使用locate position
高效的前提條件是查詢的字段上面已經(jīng)建立起了索引。
關(guān)于mysql處理百萬(wàn)級(jí)以上的數(shù)據(jù)時(shí)如何提高其查詢速度的方法
最近一段時(shí)間由于工作需要,開(kāi)始關(guān)注針對(duì)Mysql數(shù)據(jù)庫(kù)的select查詢語(yǔ)句的相關(guān)優(yōu)化方法。
由于在參與的實(shí)際項(xiàng)目中發(fā)現(xiàn)當(dāng)mysql表的數(shù)據(jù)量達(dá)到百萬(wàn)級(jí)時(shí),普通SQL查詢效率呈直線下降,而且如果where中的查詢條件較多時(shí),其查詢速度簡(jiǎn)直無(wú)法容忍。
曾經(jīng)測(cè)試對(duì)一個(gè)包含400多萬(wàn)條記錄(有索引)的表執(zhí)行一條條件查詢,其查詢時(shí)間竟然高達(dá)40幾秒,相信這么高的查詢延時(shí),任何用戶都會(huì)抓狂。因此如何提高sql語(yǔ)句查詢效率,顯得十分重要。
以下是網(wǎng)上流傳比較廣泛的30種SQL查詢語(yǔ)句優(yōu)化方法:
1、應(yīng)盡量避免在 where 子句中使用!=
或<>
操作符,否則將引擎放棄使用索引而進(jìn)行全表掃描。
2、對(duì)查詢進(jìn)行優(yōu)化,應(yīng)盡量避免全表掃描,首先應(yīng)考慮在 where 及 order by 涉及的列上建立索引。
3、應(yīng)盡量避免在 where 子句中對(duì)字段進(jìn)行 null 值判斷,否則將導(dǎo)致引擎放棄使用索引而進(jìn)行全表掃描,如:
select id from t where num is null
可以在num上設(shè)置默認(rèn)值0,確保表中num列沒(méi)有null值,然后這樣查詢:
select id from t where num=0
4、盡量避免在 where 子句中使用 or 來(lái)連接條件,否則將導(dǎo)致引擎放棄使用索引而進(jìn)行全表掃描,如:
select id from t where num=10 or num=20
可以這樣查詢:
select id from t where num=10 union all select id from t where num=20
5、下面的查詢也將導(dǎo)致全表掃描:(不能前置百分號(hào))
select id from t where name like ‘%c%'
若要提高效率,可以考慮全文檢索。
6、in 和 not in 也要慎用,否則會(huì)導(dǎo)致全表掃描,如:
select id from t where num in(1,2,3)
對(duì)于連續(xù)的數(shù)值,能用 between 就不要用 in 了:
select id from t where num between 1 and 3
7、如果在 where 子句中使用參數(shù),也會(huì)導(dǎo)致全表掃描。因?yàn)镾QL只有在運(yùn)行時(shí)才會(huì)解析局部變量,但優(yōu)化程序不能將訪問(wèn)計(jì)劃的選擇推遲到運(yùn)行時(shí);它必須在編譯時(shí)進(jìn)行選擇。然 而,如果在編譯時(shí)建立訪問(wèn)計(jì)劃,變量的值還是未知的,因而無(wú)法作為索引選擇的輸入項(xiàng)。如下面語(yǔ)句將進(jìn)行全表掃描:
select id from t where num=@num
可以改為強(qiáng)制查詢使用索引:
select id from t with(index(索引名)) where num=@num
8、應(yīng)盡量避免在 where 子句中對(duì)字段進(jìn)行表達(dá)式操作,這將導(dǎo)致引擎放棄使用索引而進(jìn)行全表掃描。如:
select id from t where num/2=100
應(yīng)改為:
select id from t where num=100*2
9、應(yīng)盡量避免在where子句中對(duì)字段進(jìn)行函數(shù)操作,這將導(dǎo)致引擎放棄使用索引而進(jìn)行全表掃描。如:
select id from t where substring(name,1,3)='abc'–name以abc開(kāi)頭的id select id from t where datediff(day,createdate,'2005-11-30′)=0–'2005-11-30′生成的id
應(yīng)改為:
select id from t where name like ‘a(chǎn)bc%' select id from t where createdate>='2005-11-30′ and createdate<'2005-12-1′
10、不要在 where 子句中的“=”左邊進(jìn)行函數(shù)、算術(shù)運(yùn)算或其他表達(dá)式運(yùn)算,否則系統(tǒng)將可能無(wú)法正確使用索引。
11、在使用索引字段作為條件時(shí),如果該索引是復(fù)合索引,那么必須使用到該索引中的第一個(gè)字段作為條件時(shí)才能保證系統(tǒng)使用該索引,否則該索引將不會(huì)被使 用,并且應(yīng)盡可能的讓字段順序與索引順序相一致。
12、不要寫(xiě)一些沒(méi)有意義的查詢,如需要生成一個(gè)空表結(jié)構(gòu):
select col1,col2 into #t from t where 1=0
這類(lèi)代碼不會(huì)返回任何結(jié)果集,但是會(huì)消耗系統(tǒng)資源的,應(yīng)改成這樣:
create table #t(…)
13、很多時(shí)候用 exists 代替 in 是一個(gè)好的選擇:
select num from a where num in(select num from b)
用下面的語(yǔ)句替換:
select num from a where exists(select 1 from b where num=a.num)
14、并不是所有索引對(duì)查詢都有效,SQL是根據(jù)表中數(shù)據(jù)來(lái)進(jìn)行查詢優(yōu)化的,當(dāng)索引列有大量數(shù)據(jù)重復(fù)時(shí),SQL查詢可能不會(huì)去利用索引,如一表中有字段 sex,male、female幾乎各一半,那么即使在sex上建了索引也對(duì)查詢效率起不了作用。
15、索引并不是越多越好,索引固然可以提高相應(yīng)的 select 的效率,但同時(shí)也降低了 insert 及 update 的效率,因?yàn)?insert 或 update 時(shí)有可能會(huì)重建索引,所以怎樣建索引需要慎重考慮,視具體情況而定。一個(gè)表的索引數(shù)最好不要超過(guò)6個(gè),若太多則應(yīng)考慮一些不常使用到的列上建的索引是否有 必要。
16.應(yīng)盡可能的避免更新 clustered
索引數(shù)據(jù)列,因?yàn)?nbsp;clustered
索引數(shù)據(jù)列的順序就是表記錄的物理存儲(chǔ)順序,一旦該列值改變將導(dǎo)致整個(gè)表記錄的順序的調(diào)整,會(huì)耗費(fèi)相當(dāng)大的資源。若應(yīng)用系統(tǒng)需要頻繁更新 clustered
索引數(shù)據(jù)列,那么需要考慮是否應(yīng)將該索引建為 clustered
索引。
17、盡量使用數(shù)字型字段,若只含數(shù)值信息的字段盡量不要設(shè)計(jì)為字符型,這會(huì)降低查詢和連接的性能,并會(huì)增加存儲(chǔ)開(kāi)銷(xiāo)。這是因?yàn)橐嬖谔幚聿樵兒瓦B接時(shí)會(huì) 逐個(gè)比較字符串中每一個(gè)字符,而對(duì)于數(shù)字型而言只需要比較一次就夠了。
18、盡可能的使用 varchar/nvarchar
代替 char/nchar
,因?yàn)槭紫茸冮L(zhǎng)字段存儲(chǔ)空間小,可以節(jié)省存儲(chǔ)空間,其次對(duì)于查詢來(lái)說(shuō),在一個(gè)相對(duì)較小的字段內(nèi)搜索效率顯然要高些。
19、任何地方都不要使用 select * from t
,用具體的字段列表代替“*
”,不要返回用不到的任何字段。
20、盡量使用表變量來(lái)代替臨時(shí)表。如果表變量包含大量數(shù)據(jù),請(qǐng)注意索引非常有限(只有主鍵索引)。
21、避免頻繁創(chuàng)建和刪除臨時(shí)表,以減少系統(tǒng)表資源的消耗。
22、臨時(shí)表并不是不可使用,適當(dāng)?shù)厥褂盟鼈兛梢允鼓承├谈行?,例如,?dāng)需要重復(fù)引用大型表或常用表中的某個(gè)數(shù)據(jù)集時(shí)。但是,對(duì)于一次性事件,最好使 用導(dǎo)出表。
23、在新建臨時(shí)表時(shí),如果一次性插入數(shù)據(jù)量很大,那么可以使用 select into
代替 create table
,避免造成大量 log ,以提高速度;如果數(shù)據(jù)量不大,為了緩和系統(tǒng)表的資源,應(yīng)先create table
,然后insert。
24、如果使用到了臨時(shí)表,在存儲(chǔ)過(guò)程的最后務(wù)必將所有的臨時(shí)表顯式刪除,先 truncate table
,然后 drop table
,這樣可以避免系統(tǒng)表的較長(zhǎng)時(shí)間鎖定。
25、盡量避免使用游標(biāo),因?yàn)橛螛?biāo)的效率較差,如果游標(biāo)操作的數(shù)據(jù)超過(guò)1萬(wàn)行,那么就應(yīng)該考慮改寫(xiě)。
26、使用基于游標(biāo)的方法或臨時(shí)表方法之前,應(yīng)先尋找基于集的解決方案來(lái)解決問(wèn)題,基于集的方法通常更有效。
27、與臨時(shí)表一樣,游標(biāo)并不是不可使用。對(duì)小型數(shù)據(jù)集使用 FAST_FORWARD
游標(biāo)通常要優(yōu)于其他逐行處理方法,尤其是在必須引用幾個(gè)表才能獲得所需的數(shù)據(jù)時(shí)。在結(jié)果集中包括“合計(jì)”的例程通常要比使用游標(biāo)執(zhí)行的速度快。如果開(kāi)發(fā)時(shí) 間允許,基于游標(biāo)的方法和基于集的方法都可以嘗試一下,看哪一種方法的效果更好。
28、在所有的存儲(chǔ)過(guò)程和觸發(fā)器的開(kāi)始處設(shè)置 SET NOCOUNT ON
,在結(jié)束時(shí)設(shè)置 SET NOCOUNT OFF
。無(wú)需在執(zhí)行存儲(chǔ)過(guò)程和觸發(fā)器的每個(gè)語(yǔ)句后向客戶端發(fā)送 DONE_IN_PROC
消息。
29、盡量避免向客戶端返回大數(shù)據(jù)量,若數(shù)據(jù)量過(guò)大,應(yīng)該考慮相應(yīng)需求是否合理。
30、盡量避免大事務(wù)操作,提高系統(tǒng)并發(fā)能力。
總結(jié)
到此這篇關(guān)于MySQL實(shí)現(xiàn)模糊查詢的高效方法總結(jié)的文章就介紹到這了,更多相關(guān)MySQL模糊查詢方法內(nèi)容請(qǐng)搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關(guān)文章希望大家以后多多支持腳本之家!
相關(guān)文章
Mysql數(shù)據(jù)庫(kù)增量備份的思路和方法
MySQL數(shù)據(jù)庫(kù)增量備份,在這之前修改我們的數(shù)據(jù)庫(kù)配置文件/etc/my.cnf開(kāi)啟bin-log日志功能即可,下面小編給大家分享Mysql數(shù)據(jù)庫(kù)增量備份的思路詳解,一起看看吧2017-09-09mysql 5.7.13 安裝配置方法圖文教程(win10)
這篇文章主要為大家分享了mysql 5.7.13 安裝配置方法圖文教程,感興趣的朋友可以參考一下2016-06-06MySQL實(shí)現(xiàn)查詢處理JSON數(shù)據(jù)的示例詳解
這篇文章主要為大家詳細(xì)介紹了MySQL如何實(shí)現(xiàn)查詢處理JSON數(shù)據(jù),文中的示例代碼講解詳細(xì),具有一定的借鑒價(jià)值,感興趣的小伙伴可以了解一下2023-06-06mysql數(shù)據(jù)庫(kù)日志binlog保存時(shí)效問(wèn)題(expire_logs_days)
這篇文章主要介紹了mysql數(shù)據(jù)庫(kù)日志binlog保存時(shí)效問(wèn)題(expire_logs_days),具有很好的參考價(jià)值,希望對(duì)大家有所幫助。如有錯(cuò)誤或未考慮完全的地方,望不吝賜教2023-03-03MySQL存儲(chǔ)過(guò)程未執(zhí)行的問(wèn)題排查過(guò)程
文章講述了對(duì) MySQL 存儲(chǔ)過(guò)程未執(zhí)行的問(wèn)題排查過(guò)程,先后排查了數(shù)據(jù)庫(kù)版本升級(jí)、用戶權(quán)限不足,最終發(fā)現(xiàn)是存儲(chǔ)過(guò)程創(chuàng)建時(shí)的 SQL 模式導(dǎo)致,即使之后去掉該模式,存儲(chǔ)過(guò)程內(nèi)部仍沿用舊模式,重新創(chuàng)建存儲(chǔ)過(guò)程后問(wèn)題解決,需要的朋友可以參考下2025-02-02MySQL對(duì)數(shù)據(jù)庫(kù)數(shù)據(jù)進(jìn)行復(fù)制的基本過(guò)程詳解
這篇文章主要介紹了MySQL對(duì)數(shù)據(jù)庫(kù)數(shù)據(jù)進(jìn)行復(fù)制的基本過(guò)程,解讀了Slave的一些相關(guān)配置,需要的朋友可以參考下2015-11-11解析MySQL設(shè)置當(dāng)前時(shí)間為默認(rèn)值的方法
本篇文章是對(duì)MySQL設(shè)置當(dāng)前時(shí)間為默認(rèn)值的方法進(jìn)行了詳細(xì)的分析介紹,需要的朋友參考下2013-06-06