刪除MySQL重復數(shù)據(jù)的方法
本文實例講述了刪除MySQL重復數(shù)據(jù)的方法。分享給大家供大家參考。具體方法如下:
項目背景
在最近做的一個linux性能采集項目中,發(fā)現(xiàn)線程的程序入庫很慢,再仔細定位,發(fā)現(xiàn)數(shù)據(jù)庫里面很多冗余數(shù)據(jù)。因為在采集中,對于同一臺設備,同一個時間點應該只有一個數(shù)據(jù),然而,數(shù)據(jù)庫中存入了多個數(shù)據(jù)。對于如何造成了這個結果,一時沒有想清楚,但為了解決入庫慢的問題,首先要刪除冗余數(shù)據(jù)。
問題描述
數(shù)據(jù)庫的表結構很簡單,如下:
| Field | Type | Null | Key | Default | Extra |
+----------------+--------------+------+-----+---------+-------+
| id | varchar(255) | NO | PRI | NULL | |
| conf_id | varchar(255) | NO | MUL | NULL | |
| insert_time | datetime | YES | | NULL | |
| cpu_usage | float(11,2) | YES | | NULL | |
| memory_usage | float(11,2) | YES | | NULL | |
| io_usage_write | float(11,2) | YES | | NULL | |
| io_usage_read | float(11,2) | YES | | NULL | |
+----------------+--------------+------+-----+---------+-------+
查詢所有數(shù)據(jù)量
輸出 427366
查詢所有時間點不同設備的數(shù)據(jù)量
輸出42387
由上面的數(shù)據(jù)可以看出,數(shù)據(jù)冗余了10倍左右。
再按時間分組看一下:
輸出:
| 50d6f6c2-9c8b-45fd-98fd-2be211221cfd | 1 | 2014-12-09 15:09:14 |
| 740b52e1-e868-4074-ba36-74e2634401b3 | 1 | 2014-12-09 15:09:14 |
| 8b0096a4-9e85-417b-a131-e3505ca79a9c | 1 | 2014-12-09 15:09:14 |
| 90a9e882-5220-4508-a56f-8d4ab4a7929b | 1 | 2014-12-09 15:09:14 |
| d17403ed-24a4-45e8-b51b-2a95118383d9 | 1 | 2014-12-09 15:09:14 |
| 0c2da917-579b-4080-857d-7159f38b44ac | 2 | 2014-12-09 15:09:14 |
| 263083eb-8f63-4d2b-a03f-3320aa678735 | 2 | 2014-12-09 15:09:14 |
| d6c57a38-080b-465a-a55a-beafd9daf32d | 2 | 2014-12-09 15:09:14 |
| f672227b-1fb8-4b85-880d-2cc34b02880d | 2 | 2014-12-09 15:09:14 |
| f80020fe-6cb5-48ec-beb0-4e8ebeb0ca57 | 2 | 2014-12-09 15:09:14 |
| ff633a35-824d-49ba-b78c-5bcc5df8d1cc | 2 | 2014-12-09 15:09:14 |
| 5c41e48a-abfc-4108-a00e-ca7def7d5a5a | 3 | 2014-12-09 15:09:14 |
| 60b7ab9e-c91a-4020-a6d3-7bceb1dc47c5 | 3 | 2014-12-09 15:09:14 |
| 7b6cd2b8-ac6d-43eb-8858-e15885e676c8 | 3 | 2014-12-09 15:09:14 |
| d53a3df5-08c4-4604-8fac-cb51077935f6 | 3 | 2014-12-09 15:09:14 |
| d9e4ba14-f98d-42a8-b3bc-2879d58aa797 | 3 | 2014-12-09 15:09:14 |
| f56f82f6-32a7-47f7-ae07-b13168743884 | 3 | 2014-12-09 15:09:14 |
| 076c4c1b-0028-4a9c-a8c4-de655bd6ab6b | 4 | 2014-12-09 15:09:14 |
| 2a90ad9e-11a5-4707-95e8-78491da658ad | 4 | 2014-12-09 15:09:14 |
| 3b17ad1d-e589-4b65-93a7-d61fc99b4071 | 4 | 2014-12-09 15:09:14 |
| 6988d6cf-44ef-47f7-808d-09791caf2d90 | 4 | 2014-12-09 15:09:14 |
| 8404d281-f9e5-4153-a47e-128c05386758 | 4 | 2014-12-09 15:09:14 |
| e042e310-7ff2-4e4d-8c98-71e3e4d57828 | 4 | 2014-12-09 15:09:14 |
+--------------------------------------+---------+---------------------+
由上圖可見,同一個時間點的同一個設備的數(shù)據(jù)有冗余,現(xiàn)在我們要把這些冗余數(shù)據(jù)去掉。
解決方法
思路是這樣的:首先應該按照conf_id和時間點來判斷,進行分組(group by)查詢,每組中再取一個就可以。分組是很簡單,但是分組怎么取一個呢?我采用了中間表的形式。
創(chuàng)建中間表,并把數(shù)據(jù)導入中間表
insert into perf_linux_t select * from perf_linux;
在中間表中增加一個字段,此字段是自增長的。
ADD COLUMN `auto_id` INT NOT NULL AUTO_INCREMENT ,
DROP PRIMARY KEY,
ADD PRIMARY KEY (`auto_id`);
刪除無用數(shù)據(jù)
先查詢一下
刪除不對的數(shù)據(jù)
慢著,輸出錯誤:
You can't specify target table 'perf_linux_t' for update in FROM clause
不能刪除啊,那只能再建一個中間表了。
再建中間表
轉變思路,不刪除不符合的數(shù)據(jù),而是把符合的數(shù)據(jù)存到這張新表中。
把這張表中的無用列刪除
DROP COLUMN `auto_id`,
DROP PRIMARY KEY;
導回數(shù)據(jù)
刪除原來的數(shù)據(jù)
插入數(shù)據(jù)
刪除中間表
drop table perf_linux_t;
總結
通過這個方法,數(shù)據(jù)變?yōu)榱?2387條,刪除了冗余的數(shù)據(jù)。但實際上程序的問題并沒有完全定位,還需要觀察才能定位問題。
希望本文所述對大家的mysql數(shù)據(jù)庫程序設計有所幫助。
- mysql 數(shù)據(jù)表中查找重復記錄
- MySQL 刪除數(shù)據(jù)庫中重復數(shù)據(jù)方法小結
- MySQL查詢重復數(shù)據(jù)(刪除重復數(shù)據(jù)保留id最小的一條為唯一數(shù)據(jù))
- 很全面的MySQL處理重復數(shù)據(jù)代碼
- MySQL數(shù)據(jù)庫中刪除重復記錄的方法總結[推薦]
- 有效查詢MySQL表中重復數(shù)據(jù)的方法和技巧分享
- MySQL 去除重復數(shù)據(jù)實例詳解
- MySQL中刪除重復數(shù)據(jù)的簡單方法
- MYSQL刪除重復數(shù)據(jù)的簡單方法
- MySQL處理重復數(shù)據(jù)完整代碼實例
相關文章
MySQL使用UNIQUE實現(xiàn)數(shù)據(jù)不重復插入
當unique列在一個UNIQUE鍵上插入包含重復值的記錄時,我們可以控制MySQL如何處理這種情況:使用IGNORE關鍵字或者ON DUPLICATE KEY UPDATE子句跳過INSERT、中斷操作或者更新舊記錄為新值。2017-05-05
MySQL 存儲過程中執(zhí)行動態(tài)SQL語句的方法
這篇文章主要介紹了MySQL 存儲過程中執(zhí)行動態(tài)SQL語句的方法,需要的朋友可以參考下2014-08-08
MySQL在關聯(lián)復雜情況下所能做出的一些優(yōu)化
這篇文章主要介紹了MySQL在關聯(lián)復雜情況下所能做出的一些優(yōu)化,作者通過添加索引來不斷優(yōu)化查詢時間,需要的朋友可以參考下2015-05-05
基于Mysql+JavaSwing的超市商品管理系統(tǒng)設計與實現(xiàn)
本項目是使用Java swing開發(fā),可實現(xiàn)超市管理系統(tǒng)商品列表信息查詢、添加商品信息和修改商品管理以及刪除商品信息和安裝商品信息查詢等功能。界面設計和功能比較簡單基礎、適合作為Java課設設計以及學習技術使用,需要的朋友可以參考一下2021-09-09

