欧美bbbwbbbw肥妇,免费乱码人妻系列日韩,一级黄片

Python讀取csv文件做K-means分析詳情

 更新時間:2022年03月30日 10:20:12   作者:空中旋轉籃球  
這篇文章主要介紹了Python讀取csv文件做K-means分析詳情,基于時間序列的分析2D讀取時間列和高程做一下分析。下文更多詳細介紹需要的小伙伴可以參考一下

1.運行環(huán)境及數據

Python3.7、PyCharm Community Edition 2021.1.1,win10系統(tǒng)。

使用的庫:matplotlib、numpy、sklearn、pandas等

數據:CSV文件,包含時間,經緯度,高程等數據

2.基于時間序列的分析2D

讀取時間列和高程做一下分析:

代碼如下:

from PIL import Image
import matplotlib.pyplot as plt
import numpy as np
from sklearn.cluster import KMeans, MiniBatchKMeans
import pandas as pd
?
if __name__ == "__main__":
? ? data = pd.read_csv(r"H:\CSDN_Test_Data\UseYourTestData.csv")
? ? x, y = data['Time (sec)'], data['Height (m HAE)']
? ? n = len(x)
? ? x = np.array(x)
? ? x = x.reshape(n, 1)#reshape 為一列
? ? y = np.array(y)
? ? y = y.reshape(n, 1)#reshape 為一列
? ? data = np.hstack((x, y)) #水平合并為兩列
? ? k = 8 ?# 設置顏色聚類的類別個數(我們分別設置8,16,32,64,128進行對比)
? ? cluster = KMeans(n_clusters=k) ?# 構造聚類器
? ? C = cluster.fit_predict(data)
? ? # C_Image = cluster.fit_predict(data)
? ? print("訓練總耗時為:%s(s)" % (Trainingtime).seconds)
? ? plt.figure()
? ? plt.scatter(data[:, 0], data[:, 1], marker='o', s=2, c=C)
? ? plt.show()

結果展示:

2.1 2000行數據結果展示

2.2 6950行數據結果展示

2.3 300M,約105萬行數據結果展示

CPU立馬90%以上了。大約1-2分鐘,也比較快了。

markersize有些大了, 將markersize改小一些顯示,設置為0.1,點太多還是不明顯。

 3.經緯度高程三維坐標分類顯示3D-空間點聚類

修改代碼,讀取相應的列修改為X,Y,Z坐標:如下:

from PIL import Image
import matplotlib.pyplot as plt
import numpy as np
from sklearn.cluster import KMeans, MiniBatchKMeans
import pandas as pd
from mpl_toolkits.mplot3d import Axes3D
?
if __name__ == "__main__":
? ? data = pd.read_csv(r"H:\CSDN_Test_Data\UseYourTestData.csv")
? ? x, y,z = data['Longitude (deg)'],data['Latitude (deg)'], ?data['Height (m HAE)']
? ? n = len(x)
? ? x = np.array(x)
? ? x = x.reshape(n, 1)#reshape 為一列
? ? y = np.array(y)
? ? y = y.reshape(n, 1)#reshape 為一列
? ? z = np.array(z)
? ? z = z.reshape(n, 1) ?# reshape 為一列
? ? data = np.hstack((x, y, z)) #水平合并為兩列
? ? k = 8 ?# 設置顏色聚類的類別個數(我們分別設置8,16,32,64,128進行對比)
? ? cluster = KMeans(n_clusters=k) ?# 構造聚類器
? ? C = cluster.fit_predict(data)
?
? ? # C_Image = cluster.fit_predict(data)
? ? print("訓練總耗時為:%s(s)" % (Trainingtime).seconds)
? ? fig = plt.figure()
? ? ax = Axes3D(fig)
?
? ? ax.scatter(data[:, 0], data[:, 1],data[:, 2], s=1, c=C)
? ? # 繪制圖例
? ? ax.legend(loc='best')
? ? # 添加坐標軸
? ? ax.set_zlabel('Z Label', fontdict={'size': 15, 'color': 'red'})
? ? ax.set_ylabel('Y Label', fontdict={'size': 15, 'color': 'red'})
? ? ax.set_xlabel('X Label', fontdict={'size': 15, 'color': 'red'})
? ? plt.show()

3.1 2000行數據結果顯示

由于經度在緯度方向上在17m范圍類,所以立體效果較差,可以換其他數據測試。

3.2 300M的CSV數據計算顯示效果

105萬行數據顯示結果:

到此這篇關于Python讀取csv文件做K-means分析詳情的文章就介紹到這了,更多相關Python讀取csv文件內容請搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關文章希望大家以后多多支持腳本之家!

相關文章

  • Python使用os模塊實現(xiàn)更高效地讀寫文件

    Python使用os模塊實現(xiàn)更高效地讀寫文件

    os是python標準庫,包含幾百個函數常用路徑操作、進程管理、環(huán)境參數等好多類。本文將使用os模塊實現(xiàn)更高效地讀寫文件,感興趣的可以學習一下
    2022-07-07
  • Python3.9 beta2版本發(fā)布了,看看這7個新的PEP都是什么

    Python3.9 beta2版本發(fā)布了,看看這7個新的PEP都是什么

    這篇文章主要介紹了Python3.9 beta2版本發(fā)布了,看看這7個新的PEP都是什么,小編覺得挺不錯的,現(xiàn)在分享給大家,也給大家做個參考。一起跟隨小編過來看看吧
    2020-06-06
  • 利用PyQt中的QThread類實現(xiàn)多線程

    利用PyQt中的QThread類實現(xiàn)多線程

    本文主要給大家分享的是python實現(xiàn)多線程及線程間通信的簡單方法,非常的實用,有需要的小伙伴可以參考下
    2020-02-02
  • Numpy 改變數組維度的幾種方法小結

    Numpy 改變數組維度的幾種方法小結

    今天小編就為大家分享一篇Numpy 改變數組維度的幾種方法小結,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧
    2018-08-08
  • Flask模板引擎之Jinja2語法介紹

    Flask模板引擎之Jinja2語法介紹

    這篇文章主要介紹了Flask模板引擎之Jinja2語法介紹,文中通過示例代碼介紹的非常詳細,對大家的學習或者工作具有一定的參考學習價值,需要的朋友們下面隨著小編來一起學習學習吧
    2019-06-06
  • Python3.5以上版本lxml導入etree報錯的解決方案

    Python3.5以上版本lxml導入etree報錯的解決方案

    這篇文章主要介紹了Python3.5以上版本lxml導入etree報錯的解決方案,文中通過示例代碼介紹的非常詳細,對大家的學習或者工作具有一定的參考學習價值,需要的朋友可以參考下
    2019-06-06
  • 詳解Numpy擴充矩陣維度(np.expand_dims, np.newaxis)和刪除維度(np.squeeze)的方法

    詳解Numpy擴充矩陣維度(np.expand_dims, np.newaxis)和刪除維度(np.squeeze)的方

    這篇文章主要介紹了詳解Numpy擴充矩陣維度(np.expand_dims, np.newaxis)和刪除維度(np.squeeze)的方法,文中通過示例代碼介紹的非常詳細,對大家的學習或者工作具有一定的參考學習價值,需要的朋友們下面隨著小編來一起學習學習吧
    2021-03-03
  • 解決Django連接db遇到的問題

    解決Django連接db遇到的問題

    今天小編大家分享一篇解決Django連接db遇到的問題,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧
    2019-08-08
  • Python網絡爬蟲之獲取網絡數據

    Python網絡爬蟲之獲取網絡數據

    本文介紹了Python中用于獲取網絡數據的重要工具之一——Requests庫,詳細講解了Requests庫的基本使用方法、請求方法、請求頭、請求參數、Cookies、Session等內容,并結合實例代碼展示了Requests庫的應用場景
    2023-04-04
  • Python中for循環(huán)語句實戰(zhàn)案例

    Python中for循環(huán)語句實戰(zhàn)案例

    這篇文章主要給大家介紹了關于Python中for循環(huán)語句的相關資料,python中for循環(huán)一般用來迭代字符串,列表,元組等,當for循環(huán)用于迭代時不需要考慮循環(huán)次數,循環(huán)次數由后面的對象長度來決定,需要的朋友可以參考下
    2023-09-09

最新評論