MySQL批量SQL插入性能優(yōu)化詳解
對(duì)于一些數(shù)據(jù)量較大的系統(tǒng),數(shù)據(jù)庫(kù)面臨的問題除了查詢效率低下,還有就是數(shù)據(jù)入庫(kù)時(shí)間長(zhǎng)。特別像報(bào)表系統(tǒng),每天花費(fèi)在數(shù)據(jù)導(dǎo)入上的時(shí)間可能會(huì)長(zhǎng)達(dá)幾個(gè)小時(shí)或十幾個(gè)小時(shí)之久。因此,優(yōu)化數(shù)據(jù)庫(kù)插入性能是很有意義的。
經(jīng)過對(duì)MySQL innodb的一些性能測(cè)試,發(fā)現(xiàn)一些可以提高insert效率的方法,供大家參考參考。
1. 一條SQL語句插入多條數(shù)據(jù)。
常用的插入語句如:
INSERT INTO `insert_table` (`datetime`, `uid`, `content`, `type`) VALUES ('0', 'userid_0', 'content_0', 0); INSERT INTO `insert_table` (`datetime`, `uid`, `content`, `type`) VALUES ('1', 'userid_1', 'content_1', 1);
修改成:
INSERT INTO `insert_table` (`datetime`, `uid`, `content`, `type`) VALUES ('0', 'userid_0', 'content_0', 0), ('1', 'userid_1', 'content_1', 1);
修改后的插入操作能夠提高程序的插入效率。這里第二種SQL執(zhí)行效率高的主要原因是合并后日志量(MySQL的binlog和innodb的事務(wù)讓 日志)減少了,降低日志刷盤的數(shù)據(jù)量和頻率,從而提高效率。通過合并SQL語句,同時(shí)也能減少SQL語句解析的次數(shù),減少網(wǎng)絡(luò)傳輸?shù)腎O。
這里提供一些測(cè)試對(duì)比數(shù)據(jù),分別是進(jìn)行單條數(shù)據(jù)的導(dǎo)入與轉(zhuǎn)化成一條SQL語句進(jìn)行導(dǎo)入,分別測(cè)試1百、1千、1萬條數(shù)據(jù)記錄。
2. 在事務(wù)中進(jìn)行插入處理。
把插入修改成:
START TRANSACTION; INSERT INTO `insert_table` (`datetime`, `uid`, `content`, `type`) VALUES ('0', 'userid_0', 'content_0', 0); INSERT INTO `insert_table` (`datetime`, `uid`, `content`, `type`) VALUES ('1', 'userid_1', 'content_1', 1); ... COMMIT;
使用事務(wù)可以提高數(shù)據(jù)的插入效率,這是因?yàn)檫M(jìn)行一個(gè)INSERT操作時(shí),MySQL內(nèi)部會(huì)建立一個(gè)事務(wù),在事務(wù)內(nèi)才進(jìn)行真正插入處理操作。通過使用事務(wù)可以減少創(chuàng)建事務(wù)的消耗,所有插入都在執(zhí)行后才進(jìn)行提交操作。
這里也提供了測(cè)試對(duì)比,分別是不使用事務(wù)與使用事務(wù)在記錄數(shù)為1百、1千、1萬的情況。
3. 數(shù)據(jù)有序插入。
數(shù)據(jù)有序的插入是指插入記錄在主鍵上是有序排列,例如datetime是記錄的主鍵:
INSERT INTO `insert_table` (`datetime`, `uid`, `content`, `type`) VALUES ('1', 'userid_1', 'content_1', 1); INSERT INTO `insert_table` (`datetime`, `uid`, `content`, `type`) VALUES ('0', 'userid_0', 'content_0', 0); INSERT INTO `insert_table` (`datetime`, `uid`, `content`, `type`) VALUES ('2', 'userid_2', 'content_2',2);
修改成:
INSERT INTO `insert_table` (`datetime`, `uid`, `content`, `type`) VALUES ('0', 'userid_0', 'content_0', 0); INSERT INTO `insert_table` (`datetime`, `uid`, `content`, `type`) VALUES ('1', 'userid_1', 'content_1', 1); INSERT INTO `insert_table` (`datetime`, `uid`, `content`, `type`) VALUES ('2', 'userid_2', 'content_2',2);
由于數(shù)據(jù)庫(kù)插入時(shí),需要維護(hù)索引數(shù)據(jù),無序的記錄會(huì)增大維護(hù)索引的成本。我們可以參照innodb使用的B+tree索引,如果每次插入記錄都在索 引的最后面,索引的定位效率很高,并且對(duì)索引調(diào)整較小;如果插入的記錄在索引中間,需要B+tree進(jìn)行分裂合并等處理,會(huì)消耗比較多計(jì)算資源,并且插入 記錄的索引定位效率會(huì)下降,數(shù)據(jù)量較大時(shí)會(huì)有頻繁的磁盤操作。
下面提供隨機(jī)數(shù)據(jù)與順序數(shù)據(jù)的性能對(duì)比,分別是記錄為1百、1千、1萬、10萬、100萬。
從測(cè)試結(jié)果來看,該優(yōu)化方法的性能有所提高,但是提高并不是很明顯。
性能綜合測(cè)試:
這里提供了同時(shí)使用上面三種方法進(jìn)行INSERT效率優(yōu)化的測(cè)試。
從測(cè)試結(jié)果可以看到,合并數(shù)據(jù)+事務(wù)的方法在較小數(shù)據(jù)量時(shí),性能提高是很明顯的,數(shù)據(jù)量較大時(shí)(1千萬以上),性能會(huì)急劇下降,這是由于此時(shí)數(shù)據(jù)量 超過了innodb_buffer的容量,每次定位索引涉及較多的磁盤讀寫操作,性能下降較快。而使用合并數(shù)據(jù)+事務(wù)+有序數(shù)據(jù)的方式在數(shù)據(jù)量達(dá)到千萬級(jí) 以上表現(xiàn)依舊是良好,在數(shù)據(jù)量較大時(shí),有序數(shù)據(jù)索引定位較為方便,不需要頻繁對(duì)磁盤進(jìn)行讀寫操作,所以可以維持較高的性能。
注意事項(xiàng):
1. SQL語句是有長(zhǎng)度限制,在進(jìn)行數(shù)據(jù)合并在同一SQL中務(wù)必不能超過SQL長(zhǎng)度限制,通過max_allowed_packet配置可以修改,默認(rèn)是1M,測(cè)試時(shí)修改為8M。
2. 事務(wù)需要控制大小,事務(wù)太大可能會(huì)影響執(zhí)行的效率。MySQL有innodb_log_buffer_size配置項(xiàng),超過這個(gè)值會(huì)把innodb的數(shù)據(jù)刷到磁盤中,這時(shí),效率會(huì)有所下降。所以比較好的做法是,在數(shù)據(jù)達(dá)到這個(gè)這個(gè)值前進(jìn)行事務(wù)提交。
以上就是本文的全部?jī)?nèi)容,希望對(duì)大家的學(xué)習(xí)有所幫助,也希望大家多多支持腳本之家。
相關(guān)文章
MySQL數(shù)據(jù)庫(kù)恢復(fù)(使用mysqlbinlog命令)
binlog是通過記錄二進(jìn)制文件方式來備份數(shù)據(jù),然后在從二進(jìn)制文件將數(shù)據(jù)恢復(fù)到某一時(shí)段或某一操作點(diǎn)。2011-08-08MySQL切分函數(shù)substring()的具體使用
這篇文章主要介紹了MySQL切分函數(shù)substring()的具體使用,文中通過示例代碼介紹的非常詳細(xì),對(duì)大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價(jià)值,需要的朋友們下面隨著小編來一起學(xué)習(xí)學(xué)習(xí)吧2021-02-02MySQL將多條數(shù)據(jù)合并成一條的完整代碼示例
我們?cè)诓僮鲾?shù)據(jù)的時(shí)候,有時(shí)候需要把多行數(shù)據(jù),拼接成一行,下面這篇文章主要給大家介紹了關(guān)于MySQL將多條數(shù)據(jù)合并成一條的完整代碼示例,文中通過圖文介紹的非常詳細(xì),需要的朋友可以參考下2024-05-05軟件測(cè)試-MySQL(六:數(shù)據(jù)庫(kù)函數(shù))
這篇文章主要介紹了MySQL數(shù)據(jù)庫(kù)函數(shù),文中通過示例代碼介紹的非常詳細(xì),對(duì)大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價(jià)值,需要的朋友們下面隨著小編來一起學(xué)習(xí)學(xué)習(xí)吧2019-04-04MySQL如何實(shí)現(xiàn)跨庫(kù)join查詢
這篇文章主要介紹了MySQL如何實(shí)現(xiàn)跨庫(kù)join查詢問題,具有很好的參考價(jià)值,希望對(duì)大家有所幫助。如有錯(cuò)誤或未考慮完全的地方,望不吝賜教2023-03-03mysql tmp_table_size優(yōu)化之設(shè)置多大合適
這篇文章主要介紹了mysql tmp_table_size優(yōu)化問題,很多朋友都會(huì)問tmp_table_size設(shè)置多大合適,其實(shí)既然你都搜索到這篇文章了,一般大于64M比較好,當(dāng)然你也可以可以根據(jù)自己的機(jī)器內(nèi)容配置增加,一般64位的系統(tǒng)能充分利用大內(nèi)存2016-05-05Mysql中 show table status 獲取表信息的方法
這篇文章主要介紹了Mysql中 show table status 獲取表信息的方法的相關(guān)資料,需要的朋友可以參考下2016-03-03