Pandas分組與排序的實(shí)現(xiàn)
一、pandas分組
1、分組運(yùn)算過(guò)程:split->apply->combine
- 拆分:進(jìn)行分組的根據(jù)
- 應(yīng)用:每個(gè)分組運(yùn)行的計(jì)算規(guī)則
- 合并:把每個(gè)分組的計(jì)算結(jié)果合并起來(lái)
2、分組函數(shù)
DataFrame.groupby(by=None, axis=0, level=None, as_index=True, sort=True, group_keys=True, squeeze=False, observed=False, **kwargs
by: 依據(jù)哪些列進(jìn)行分組,值可以是:mapping, function, label, or list of labels
3、聚合函數(shù)
4、分組聚合實(shí)例
單列分組
>>> import pandas as pd >>> df = pd.DataFrame({'A': ['a', 'b', 'a', 'c', 'a', 'c', 'b', 'c'], 'B': [2, 8, 1, 4, 3, 2, 5, 9], 'C': [102, 98, 107, 104, 115, 87, 92, 123], 'D': [2, 98, 17, 14, 15, 7, 92, 13]}) >>> df A B C D 0 a 2 102 2 1 b 8 98 98 2 a 1 107 17 3 c 4 104 14 4 a 3 115 15 5 c 2 87 7 6 b 5 92 92 7 c 9 123 13 >>> df.groupby(by='A').sum() B C D A a 6 324 34 b 13 190 190 c 15 314 34
多列分組
>>> df.groupby(by=['A','B']).sum() ###A,B成索引 C D A B a 1 107 17 2 102 2 3 115 15 b 5 92 92 8 98 98 c 2 87 7 4 104 14 9 123 13
多列聚合
>>> df.groupby(by=['A','B'])['C'].sum() ###1個(gè)列 A B a 1 107 2 102 3 115 b 5 92 8 98 c 2 87 4 104 9 123 >>> df.groupby(by=['A','B'])['C','D'].sum() ###2個(gè)列 C D A B a 1 107 17 2 102 2 3 115 15 b 5 92 92 8 98 98 c 2 87 7 4 104 14 9 123 13
多列不同聚合方式
>>> import numpy as np >>> df.groupby(by=['A']).agg({'C':[np.mean, 'sum'], 'D':['count',np.std]}) C D mean sum count std A a 108.000000 324 3 8.144528 b 95.000000 190 2 4.242641 c 104.666667 314 3 3.785939 >>>ps: 不同列使用多個(gè)不同函數(shù)進(jìn)行聚合C: mean,sum;D:count,std
返回值類型區(qū)別
方法1:agg >>> df.groupby(by=['A']).agg({'C':[np.mean]}) C mean A a 108.000000 b 95.000000 c 104.666667 >>> type(df.groupby(by=['A']).agg({'C':[np.mean]})) <class 'pandas.core.frame.DataFrame'> 方法2:索引 >>> df.groupby(by=['A'])['C'].mean() A a 108.000000 b 95.000000 c 104.666667 Name: C, dtype: float64 >>> type(df.groupby(by=['A'])['C'].mean()) <class 'pandas.core.series.Series'> 總結(jié): 兩種方法結(jié)果一樣,但是一個(gè)類型是DataFrame,一個(gè)為Series;有時(shí)候會(huì)用上
二、pandas排序
按索引進(jìn)行降序排列
>>> df A B C D 0 a 2 102 2 1 b 8 98 98 2 a 1 107 17 3 c 4 104 14 4 a 3 115 15 5 c 2 87 7 6 b 5 92 92 7 c 9 123 13 >>> df.sort_index(ascending=False) ### 索引 A B C D 7 c 9 123 13 6 b 5 92 92 5 c 2 87 7 4 a 3 115 15 3 c 4 104 14 2 a 1 107 17 1 b 8 98 98 0 a 2 102 2
按值進(jìn)行降序排列
>>> df.sort_values(by="A",ascending=False) # 按某一列 A B C D 3 c 4 104 14 5 c 2 87 7 7 c 9 123 13 1 b 8 98 98 6 b 5 92 92 0 a 2 102 2 2 a 1 107 17 4 a 3 115 15 >>> df.sort_values(by=["B","A"],ascending=False) # 按2列 A B C D 7 c 9 123 13 1 b 8 98 98 6 b 5 92 92 3 c 4 104 14 4 a 3 115 15 5 c 2 87 7 0 a 2 102 2 2 a 1 107 17
以上就是本文的全部?jī)?nèi)容,希望對(duì)大家的學(xué)習(xí)有所幫助,也希望大家多多支持腳本之家。
- Pandas之排序函數(shù)sort_values()的實(shí)現(xiàn)
- Python數(shù)據(jù)分析Pandas?Dataframe排序操作
- 使用Pandas對(duì)數(shù)據(jù)進(jìn)行篩選和排序的實(shí)現(xiàn)
- pandas通過(guò)索引進(jìn)行排序的示例
- pandas多級(jí)分組實(shí)現(xiàn)排序的方法
- pandas的排序和排名的具體使用
- 淺談Pandas 排序之后索引的問(wèn)題
- Pandas數(shù)值排序 sort_values()的使用
- pandas中DataFrame排序及分組排序的實(shí)現(xiàn)示例
相關(guān)文章
Python內(nèi)置方法實(shí)現(xiàn)字符串的秘鑰加解密(推薦)
在Python中實(shí)現(xiàn)AES算法需要借助的第三方庫(kù)Crypto,其在各個(gè)操作系統(tǒng)上的安裝方法有些許復(fù)雜,所以對(duì)于簡(jiǎn)單的使用有點(diǎn)殺雞用牛刀的意思。這篇文章主要介紹了利用Python內(nèi)置方法實(shí)現(xiàn)字符串的秘鑰加解密,需要的朋友可以參考下2019-12-12Python讀取HDFS目錄下的所有文件的實(shí)現(xiàn)示例
HDFS是Apache Hadoop的分布式文件系統(tǒng),本文主要介紹了Python讀取HDFS目錄下的所有文件的實(shí)現(xiàn)示例,文中通過(guò)示例代碼介紹的非常詳細(xì),對(duì)大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價(jià)值,需要的朋友們下面隨著小編來(lái)一起學(xué)習(xí)學(xué)習(xí)吧2023-07-07利用Python代碼實(shí)現(xiàn)一鍵摳背景功能
這篇文章主要給大家介紹了關(guān)于如何利用Python代碼實(shí)現(xiàn)一鍵摳背景的相關(guān)資料,文中通過(guò)示例代碼介紹的非常詳細(xì),對(duì)大家學(xué)習(xí)或者使用Python具有一定的參考學(xué)習(xí)價(jià)值,需要的朋友們下面來(lái)一起學(xué)習(xí)學(xué)習(xí)吧2019-12-12Python pandas實(shí)現(xiàn)excel工作表合并功能詳解
這篇文章主要介紹了Python pandas實(shí)現(xiàn)excel工作表合并功能以及相關(guān)實(shí)例代碼,需要的朋友們參考學(xué)習(xí)下。2019-08-08詳解Pytorch 使用Pytorch擬合多項(xiàng)式(多項(xiàng)式回歸)
這篇文章主要介紹了詳解Pytorch 使用Pytorch擬合多項(xiàng)式(多項(xiàng)式回歸),小編覺(jué)得挺不錯(cuò)的,現(xiàn)在分享給大家,也給大家做個(gè)參考。一起跟隨小編過(guò)來(lái)看看吧2018-05-05Python如何利用pandas讀取csv數(shù)據(jù)并繪圖
這篇文章主要介紹了Python如何利用pandas讀取csv數(shù)據(jù)并繪圖,具有很好的參考價(jià)值,希望對(duì)大家有所幫助。如有錯(cuò)誤或未考慮完全的地方,望不吝賜教2022-07-07解決pycharm導(dǎo)入本地py文件時(shí),模塊下方出現(xiàn)紅色波浪線的問(wèn)題
這篇文章主要介紹了解決pycharm導(dǎo)入本地py文件時(shí),模塊下方出現(xiàn)紅色波浪線的問(wèn)題,具有很好的參考價(jià)值,希望對(duì)大家有所幫助。一起跟隨小編過(guò)來(lái)看看吧2020-06-06python調(diào)用系統(tǒng)中應(yīng)用程序的函數(shù)示例
這篇文章主要為大家介紹了python調(diào)用系統(tǒng)中應(yīng)用程序詳解,有需要的朋友可以借鑒參考下,希望能夠有所幫助,祝大家多多進(jìn)步,早日升職加薪2022-06-06python中for用來(lái)遍歷range函數(shù)的方法
今天小編就為大家分享一篇python中for用來(lái)遍歷range函數(shù)的方法,具有很好的參考價(jià)值,希望對(duì)大家有所幫助。一起跟隨小編過(guò)來(lái)看看吧2018-06-06