MySQL實現批量插入以優化效能的教程

2022-10-06 01:42:07 字數 2796 閱讀 7847

對於一些資料量較大的系統,資料庫面臨的問題除了查詢效率低下,還有就是資料入庫時間長。特別像報表系統,每天花費在資料匯入上的時間可能會長達幾個小時或十幾個小時之久。因此,優化資料庫插入效能是很有意義的。

經過對mysql innodb的一些效能測試,發現一些可以提高insert效率的方法,供大家參考參考。

1. 一條sql語句插入多條資料。

常用的插入語句如:

insert into `insert_table` (`datetime`, `uid`, `content`, `type`)

values ('0', 'userid_0', 'content_0', 0);

insert into `insert_table` (`datetime`, `uid`, `content`, `type`)

values ('1', 'userid_1', 'content_1', 1);

修改成:

insert into `insert_table` (`datetime`, `uid`, `content`, `type`)

values ('0', 'userid_0', 'content_0', 0), ('1', 'userid_1', 'content_1', 1);

修改後的插入操作能夠提高程式的插入效率。這裡第二種sql執行效率高的主要原因是合併後日誌量(mysql的binlog和innodb的事務讓日誌)減少了,降低日誌刷盤的資料量和頻率,從而提高效率。通過合併sql語句,同時也能減少sql語句解析的次數,減少網路傳輸的io。

這裡提供一些測試對比資料,分別是進行單條資料的匯入與轉化成一條sql語句進行匯入,分別測試1百、1千、1萬條資料記錄。

2. 在事務中進行插入處理。

把插入修改成:

start transaction;

insert into `insert_table` (`datetime`, `uid`, `content`, `type`)

values ('0', 'userid_0', 'content_0', 0);

insert into `insert_table` (`datetime`, `uid`, `content`, `type`)

values ('1', '程式設計客棧userid_1', 'content_1', 1);

...commit;

3. 資料有序插入。

資料有序的插入是指插入記錄在主鍵上是有序排列,例如datetime是記錄的主鍵:

insert into `insert_table` (`datetime`, `uid`, `content`, `type`)

values ('1'vvdjt, 'userid_1', 'content_1', 1);

insert into `insert_table` (`datetime`, `uid`, `content`, `type`)

values ('0', 'userid_0', 'content_0', 0);

insert into `ins (`datetime`, `uid`, `content`, `type`)

values ('2', 'userid_2', 'content_2',2);

修改成:

insert into `insert_table` (`datetime`, `uid`, `content`, `type`)

values ('0', 'userid_0', 'content_0', 0);

insert into `insert_table` (`datetime`, `uid`, `content`, `type`)

values ('1', 'userid_1', 'content_1', 1www.cppcns.com);

insert into `insert_table` (`datetime`, `uid`, `content`, `type`)

values ('2', 'userid_2', 'content_2',2);

由於資料庫插入時,需要維護索引資料,無序的記錄會增大維護索引的成本。我們可以參照innodb使用的b+tr索引,如果每次插入記錄都在索引的最後面,索引的定位效率很高,並且對索引調整較小;如果插入的記錄在索引中間,需要b+tree進行**合併等處理,會消耗比較多計算資源,並且插入記錄的索引定位效率會下降,資料量較大時會有頻繁的磁碟操作。

下面提供隨機資料與順序資料的效能對比,分別是記錄為1百、1千、1萬、10萬、100萬。

從測試結果來看,該優化方法的效能有所提高,但是提高並不是很明顯。

效能綜合測試:

這裡提供了同時使用上面三種方法進行insert效率優化的測試。

從測試結果可以看到,合併資料+事務的方法在較小資料量時,效能提高是很明顯的,資料量較大時(1千萬以上),效能會急劇下降,這是由於此時資料量超過了innodb_buffer的容量,每次定位索引涉及較多的磁碟讀寫操作,效能下降較快。而使用合併資料+事務+有序資料的方式在資料量達到千萬級以上表現依舊是良好,在資料量較大時,有序資料索引定位較為方便,不需要頻繁對磁碟進行讀寫操作,所以可以維持較高的效能。

注意事項:

1. sql語句是有長度限制,在進行資料合併在同一sql中務必不能超過sql長度限制,通過max_allowed_packet配置可以修改,預設是1m,測試時修改為8m。

2. 事務需要控制大小,事務太大可能會影響執行的效率。mysql有innodb_log_buffer_size配置項,超過這個值會把innodb的資料刷到磁碟中,這時,效率會有所下降。所以比較好的做法是,在資料達到這個這個值前進行事務提交。

本文標題: mysql實現批量插入以優化效能的教程

本文位址:

Mysql批量插入更新效能優化

對於資料量較大的插入和更新,因io cpu等效能瓶頸,會產生大量的時間消耗,目前主流的優化主要包括預編譯 單條sql插入多條資料 事務插入等,下面詳細介紹一下 單條插入 mybatis insert into sys city city code,city name,province name,al...

mysql 批量插入 Mysql批量插入分析

前言最近發現幾個專案中都有批次插入資料庫的功能,每個專案中批次插入的寫法有一些差別,所以本文打算對mysql的批次插入做乙個詳細的分析。準備1.jdk1.7,mysql5.6.38 2.準備庫和表 測試與分析 下面準備幾種插入的方式來分析優劣 1.statement插入方式 準備資料,然後通過sta...

MySQL優化之海量資料批量插入

問 為何對同乙個表的插入多執行緒會比單執行緒快?同一時間對乙個表的寫操作不應該是獨佔的嗎?答 在資料裡做插入操作的時候,整體時間的分配是這樣的 鏈結耗時 30 傳送query到伺服器 20 解析query 20 插入操作 10 詞條數目 插入index 10 index的數目 關閉鏈結 10 從這裡...