當前位置:首頁 > 芯聞號 > 充電吧
[導(dǎo)讀]對于一些數(shù)據(jù)量較大的系統(tǒng),數(shù)據(jù)庫面臨的問題除了查詢效率低下,還有就是數(shù)據(jù)入庫時間長。特別像報表系統(tǒng),每天花費在數(shù)據(jù)導(dǎo)入上的時間可能會長達幾個小時或十幾個小時之久。因此,優(yōu)化數(shù)據(jù)庫插入性能是很有意義的。

對于一些數(shù)據(jù)量較大的系統(tǒng),數(shù)據(jù)庫面臨的問題除了查詢效率低下,還有就是數(shù)據(jù)入庫時間長。特別像報表系統(tǒng),每天花費在數(shù)據(jù)導(dǎo)入上的時間可能會長達幾個小時或十幾個小時之久。因此,優(yōu)化數(shù)據(jù)庫插入性能是很有意義的。

經(jīng)過對MySQL InnoDB的一些性能測試,發(fā)現(xiàn)一些可以提高insert效率的方法,供大家參考參考。



1、一條SQL語句插入多條數(shù)據(jù)
常用的插入語句如:

????INSERT?INTO?`insert_table`?(`datetime`,?`uid`,?`content`,?`type`)???
????????VALUES?('0',?'userid_0',?'content_0',?0);??
????INSERT?INTO?`insert_table`?(`datetime`,?`uid`,?`content`,?`type`)???
????????VALUES?('1',?'userid_1',?'content_1',?1);

修改成:

????INSERT?INTO?`insert_table`?(`datetime`,?`uid`,?`content`,?`type`)???
????????VALUES?('0',?'userid_0',?'content_0',?0),?('1',?'userid_1',?'content_1',?1);

修改后的插入操作能夠提高程序的插入效率。這里第二種SQL執(zhí)行效率高的主要原因是合并后日志量(MySQL的binlog和innodb的事務(wù)讓日志)減少了,降低日志刷盤的數(shù)據(jù)量和頻率,從而提高效率。通過合并SQL語句,同時也能減少SQL語句解析的次數(shù),減少網(wǎng)絡(luò)傳輸?shù)腎O。
這里提供一些測試對比數(shù)據(jù),分別是進行單條數(shù)據(jù)的導(dǎo)入與轉(zhuǎn)化成一條SQL語句進行導(dǎo)入,分別測試1百、1千、1萬條數(shù)據(jù)記錄。



2、在事務(wù)中進行插入處理。把插入修改成:


????START?TRANSACTION;??
????INSERT?INTO?`insert_table`?(`datetime`,?`uid`,?`content`,?`type`)???
????????VALUES?('0',?'userid_0',?'content_0',?0);??
????INSERT?INTO?`insert_table`?(`datetime`,?`uid`,?`content`,?`type`)???
????????VALUES?('1',?'userid_1',?'content_1',?1);??
????...??
????COMMIT;

使用事務(wù)可以提高數(shù)據(jù)的插入效率,這是因為進行一個INSERT操作時,MySQL內(nèi)部會建立一個事務(wù),在事務(wù)內(nèi)才進行真正插入處理操作。通過使用事務(wù)可以減少創(chuàng)建事務(wù)的消耗,所有插入都在執(zhí)行后才進行提交操作。
這里也提供了測試對比,分別是不使用事務(wù)與使用事務(wù)在記錄數(shù)為1百、1千、1萬的情況。


3、數(shù)據(jù)有序插入。數(shù)據(jù)有序的插入是指插入記錄在主鍵上是有序排列,例如datetime是記錄的主鍵:


????INSERT?INTO?`insert_table`?(`datetime`,?`uid`,?`content`,?`type`)???
????????VALUES?('1',?'userid_1',?'content_1',?1);??
????INSERT?INTO?`insert_table`?(`datetime`,?`uid`,?`content`,?`type`)???
????????VALUES?('0',?'userid_0',?'content_0',?0);??
????INSERT?INTO?`insert_table`?(`datetime`,?`uid`,?`content`,?`type`)???
????????VALUES?('2',?'userid_2',?'content_2',2);


修改成:

????INSERT?INTO?`insert_table`?(`datetime`,?`uid`,?`content`,?`type`)???
????????VALUES?('0',?'userid_0',?'content_0',?0);??
????INSERT?INTO?`insert_table`?(`datetime`,?`uid`,?`content`,?`type`)???
????????VALUES?('1',?'userid_1',?'content_1',?1);??
????INSERT?INTO?`insert_table`?(`datetime`,?`uid`,?`content`,?`type`)???
????????VALUES?('2',?'userid_2',?'content_2',2);

由于數(shù)據(jù)庫插入時,需要維護索引數(shù)據(jù),無序的記錄會增大維護索引的成本。我們可以參照InnoDB使用的B+tree索引,如果每次插入記錄都在索引的最后面,索引的定位效率很高,并且對索引調(diào)整較?。蝗绻迦氲挠涗浽谒饕虚g,需要B+tree進行分裂合并等處理,會消耗比較多計算資源,并且插入記錄的索引定位效率會下降,數(shù)據(jù)量較大時會有頻繁的磁盤操作。
下面提供隨機數(shù)據(jù)與順序數(shù)據(jù)的性能對比,分別是記錄為1百、1千、1萬、10萬、100萬。

從測試結(jié)果來看,該優(yōu)化方法的性能有所提高,但是提高并不是很明顯。


4、性能綜合測試這里提供了同時使用上面三種方法進行INSERT效率優(yōu)化的測試。


從測試結(jié)果可以看到,合并數(shù)據(jù)+事務(wù)的方法在較小數(shù)據(jù)量時,性能提高是很明顯的,數(shù)據(jù)量較大時(1千萬以上),性能會急劇下降,這是由于此時數(shù)據(jù)量超過了innodb_buffer的容量,每次定位索引涉及較多的磁盤讀寫操作,性能下降較快。而使用合并數(shù)據(jù)+事務(wù)+有序數(shù)據(jù)的方式在數(shù)據(jù)量達到千萬級以上表現(xiàn)依舊是良好,在數(shù)據(jù)量較大時,有序數(shù)據(jù)索引定位較為方便,不需要頻繁對磁盤進行讀寫操作,所以可以維持較高的性能。


注意事項:

SQL語句是有長度限制,在進行數(shù)據(jù)合并在同一SQL中務(wù)必不能超過SQL長度限制,通過max_allowed_packet配置可以修改,默認是1M,測試時修改為8M。

事務(wù)需要控制大小,事務(wù)太大可能會影響執(zhí)行的效率。MySQL有innodb_log_buffer_size配置項,超過這個值會把innodb的數(shù)據(jù)刷到磁盤中,這時,效率會有所下降。所以比較好的做法是,在數(shù)據(jù)達到這個這個值前進行事務(wù)提交。




本站聲明: 本文章由作者或相關(guān)機構(gòu)授權(quán)發(fā)布,目的在于傳遞更多信息,并不代表本站贊同其觀點,本站亦不保證或承諾內(nèi)容真實性等。需要轉(zhuǎn)載請聯(lián)系該專欄作者,如若文章內(nèi)容侵犯您的權(quán)益,請及時聯(lián)系本站刪除。
換一批
延伸閱讀

9月2日消息,不造車的華為或?qū)⒋呱龈蟮莫毥谦F公司,隨著阿維塔和賽力斯的入局,華為引望愈發(fā)顯得引人矚目。

關(guān)鍵字: 阿維塔 塞力斯 華為

加利福尼亞州圣克拉拉縣2024年8月30日 /美通社/ -- 數(shù)字化轉(zhuǎn)型技術(shù)解決方案公司Trianz今天宣布,該公司與Amazon Web Services (AWS)簽訂了...

關(guān)鍵字: AWS AN BSP 數(shù)字化

倫敦2024年8月29日 /美通社/ -- 英國汽車技術(shù)公司SODA.Auto推出其旗艦產(chǎn)品SODA V,這是全球首款涵蓋汽車工程師從創(chuàng)意到認證的所有需求的工具,可用于創(chuàng)建軟件定義汽車。 SODA V工具的開發(fā)耗時1.5...

關(guān)鍵字: 汽車 人工智能 智能驅(qū)動 BSP

北京2024年8月28日 /美通社/ -- 越來越多用戶希望企業(yè)業(yè)務(wù)能7×24不間斷運行,同時企業(yè)卻面臨越來越多業(yè)務(wù)中斷的風險,如企業(yè)系統(tǒng)復(fù)雜性的增加,頻繁的功能更新和發(fā)布等。如何確保業(yè)務(wù)連續(xù)性,提升韌性,成...

關(guān)鍵字: 亞馬遜 解密 控制平面 BSP

8月30日消息,據(jù)媒體報道,騰訊和網(wǎng)易近期正在縮減他們對日本游戲市場的投資。

關(guān)鍵字: 騰訊 編碼器 CPU

8月28日消息,今天上午,2024中國國際大數(shù)據(jù)產(chǎn)業(yè)博覽會開幕式在貴陽舉行,華為董事、質(zhì)量流程IT總裁陶景文發(fā)表了演講。

關(guān)鍵字: 華為 12nm EDA 半導(dǎo)體

8月28日消息,在2024中國國際大數(shù)據(jù)產(chǎn)業(yè)博覽會上,華為常務(wù)董事、華為云CEO張平安發(fā)表演講稱,數(shù)字世界的話語權(quán)最終是由生態(tài)的繁榮決定的。

關(guān)鍵字: 華為 12nm 手機 衛(wèi)星通信

要點: 有效應(yīng)對環(huán)境變化,經(jīng)營業(yè)績穩(wěn)中有升 落實提質(zhì)增效舉措,毛利潤率延續(xù)升勢 戰(zhàn)略布局成效顯著,戰(zhàn)新業(yè)務(wù)引領(lǐng)增長 以科技創(chuàng)新為引領(lǐng),提升企業(yè)核心競爭力 堅持高質(zhì)量發(fā)展策略,塑強核心競爭優(yōu)勢...

關(guān)鍵字: 通信 BSP 電信運營商 數(shù)字經(jīng)濟

北京2024年8月27日 /美通社/ -- 8月21日,由中央廣播電視總臺與中國電影電視技術(shù)學(xué)會聯(lián)合牽頭組建的NVI技術(shù)創(chuàng)新聯(lián)盟在BIRTV2024超高清全產(chǎn)業(yè)鏈發(fā)展研討會上宣布正式成立。 活動現(xiàn)場 NVI技術(shù)創(chuàng)新聯(lián)...

關(guān)鍵字: VI 傳輸協(xié)議 音頻 BSP

北京2024年8月27日 /美通社/ -- 在8月23日舉辦的2024年長三角生態(tài)綠色一體化發(fā)展示范區(qū)聯(lián)合招商會上,軟通動力信息技術(shù)(集團)股份有限公司(以下簡稱"軟通動力")與長三角投資(上海)有限...

關(guān)鍵字: BSP 信息技術(shù)
關(guān)閉
關(guān)閉