Pandas DataFrame求差集的示例代碼
在Pandas中 求差集沒(méi)有專門(mén)的函數(shù)。處理辦法就是將兩個(gè)DataFrame追加合并,然后去重。
divident.append(hasThisYearDivident) noHasThisYearDivident = divident.drop_duplicates(subset='ts_code', keep=False, inplace=True, ignore_index=True)
具體函數(shù)用法:


補(bǔ)充示例:Pandas中兩個(gè)DataFrame的差集
在pandas中,兩個(gè)DataFrame的差集并沒(méi)有直接的庫(kù)內(nèi)置方法,現(xiàn)在我們希望有一種方法,就像python中set內(nèi)置的求差集一樣,來(lái)找到兩個(gè)DataFrame的差集。
>>> a=set((1,2,3))
>>> a
{1, 2, 3}
>>> b=set((2,3,4))
>>> b
{2, 3, 4}
>>> a-b
{1}
上面代碼片段是對(duì)set的內(nèi)置求差集方法的回顧,現(xiàn)在我們希望能有類似的方法來(lái)找兩個(gè)DataFrame的差集。
解決思路是這樣的:
對(duì)于有同樣Index的a,b兩個(gè)DataFrame,如果現(xiàn)在要求a對(duì)b的差集,那么可以(1)連續(xù)兩次擴(kuò)充a,使用append方法(2)然后使用drop_duplicates方法對(duì)a進(jìn)行去重,并且參數(shù)keep=False。原理很簡(jiǎn)單,也很巧妙,連續(xù)擴(kuò)充2次a,那么新擴(kuò)充完后的DataFrame中來(lái)自b的row肯定是重復(fù)的,去重時(shí)候,b全部被刪除,與此同時(shí),a中跟b重復(fù)的row也會(huì)順帶著被刪除。
代碼實(shí)現(xiàn):
>>> import pandas as pd
>>> data_a={'state':[1,1,2],'pop':['a','b','c']}
>>> data_b={'state':[1,2,3],'pop':['b','c','d']}
>>> a=pd.DataFrame(data_a)
>>> b=pd.DataFrame(data_b)
>>> a
state pop
0 1 a
1 1 b
2 2 c
>>> b
state pop
0 1 b
1 2 c
2 3 d
>>> a=a.append(b)
>>> a=a.append(b)
>>> a
state pop
0 1 a
1 1 b
2 2 c
0 1 b
1 2 c
2 3 d
0 1 b
1 2 c
2 3 d
>>> a.drop_duplicates(subset=['state','pop'],keep=False)
state pop
0 1 a
到此這篇關(guān)于Pandas DataFrame求差集的示例代碼的文章就介紹到這了,更多相關(guān)Pandas DataFrame求差集內(nèi)容請(qǐng)搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關(guān)文章希望大家以后多多支持腳本之家!
相關(guān)文章
Keras自定義實(shí)現(xiàn)帶masking的meanpooling層方式
這篇文章主要介紹了Keras自定義實(shí)現(xiàn)帶masking的meanpooling層方式,具有很好的參考價(jià)值,希望對(duì)大家有所幫助。一起跟隨小編過(guò)來(lái)看看吧2020-06-06
python mysql項(xiàng)目實(shí)戰(zhàn)及框架搭建過(guò)程
本文給大家分享python mysql項(xiàng)目實(shí)戰(zhàn)框架搭建過(guò)程,通過(guò)實(shí)例代碼給大家講解python mysql項(xiàng)目實(shí)戰(zhàn)的相關(guān)知識(shí),需要的朋友參考下吧2021-06-06
python中for循環(huán)把字符串或者字典添加到列表的方法
今天小編就為大家分享一篇python中for循環(huán)把字符串或者字典添加到列表的方法,具有很好的參考價(jià)值,希望對(duì)大家有所幫助。一起跟隨小編過(guò)來(lái)看看吧2019-07-07
如何使用Python在2秒內(nèi)評(píng)估國(guó)際象棋位置詳解
關(guān)心編程語(yǔ)言的使用趨勢(shì)的人都知道,最近幾年,國(guó)內(nèi)最火的兩種語(yǔ)言非Python與Go莫屬,下面這篇文章主要給大家介紹了關(guān)于如何使用Python在2秒內(nèi)評(píng)估國(guó)際象棋位置的相關(guān)資料,需要的朋友可以參考下2022-05-05
python調(diào)用DLL與EXE文件截屏對(duì)比分析
這篇文章主要為大家介紹了python調(diào)用DLL與EXE文件截屏對(duì)比分析,有需要的朋友可以借鑒參考下,希望能夠有所幫助,祝大家多多進(jìn)步,早日升職加薪2021-10-10
Keras 數(shù)據(jù)增強(qiáng)ImageDataGenerator多輸入多輸出實(shí)例
這篇文章主要介紹了Keras 數(shù)據(jù)增強(qiáng)ImageDataGenerator多輸入多輸出實(shí)例,具有很好的參考價(jià)值,希望對(duì)大家有所幫助。一起跟隨小編過(guò)來(lái)看看吧2020-07-07
python使用PIL模塊實(shí)現(xiàn)給圖片打水印的方法
這篇文章主要介紹了python使用PIL模塊實(shí)現(xiàn)給圖片打水印的方法,涉及使用PIL模塊操作圖片的相關(guān)技巧,需要的朋友可以參考下2015-05-05

