pandas 對(duì)日期類型數(shù)據(jù)的處理方法詳解
pandas 的日期/時(shí)間類型有如下幾種:
Concept | Scalar Class | Array Class | pandas Data Type | Primary Creation Method |
---|---|---|---|---|
Date times | Timestamp | DatetimeIndex | datetime64[ns] or datetime64[ns, tz] | to_datetime or date_range |
Time deltas | Timedelta | TimedeltaIndex | timedelta64[ns] | to_timedelta or timedelta_range |
Time spans | Period | PeriodIndex | period[freq] | Period or period_range |
Date offsets | DateOffset | None | None | DateOffset |
本文介紹在處理時(shí)點(diǎn)數(shù) (point in time) 一些常用的處理方法,仍然以上一篇的示例數(shù)據(jù)為例進(jìn)行講解。pandas 用 Timestamp 表示時(shí)點(diǎn)數(shù),在大多數(shù)情況下和 python 的 datetime 類型的使用方法是通用的。
首先獲取數(shù)據(jù),并且將 DataFrame 的 date 列轉(zhuǎn)換成 datetime 類型:
df1 = pd.read_csv('https://raw.githubusercontent.com/stonewm/python-practice-projects/master/pandas%20sample%20data/sample-salesv3.csv') df1['date'] = pd.to_datetime(df1['date']) # convert date column to datetime df1.head()
也可以在 read_csv() 方法中,通過 parse_dates 參數(shù)直接將某些列轉(zhuǎn)換成 datetime64 類型:
df1 = pd.read_csv('sample-salesv3.csv', parse_dates=['date'])
我們據(jù)此銷售數(shù)據(jù),按月份、按季度統(tǒng)計(jì) sku 的銷售金額。
pandas 的 pandas.Series.dt 可以獲得日期/時(shí)間類型的相關(guān)信息。比如
df1['date'].dt.year df1['date'].dt.month df1['date'].dt.quarter
但這些類型返回值為 int 類型,作為統(tǒng)計(jì)的字段,我們更希望是 2014-04 這樣的格式,有兩個(gè)方法:
# 方法 1 df1['year_month'] = df1['date'].apply(lambda x : x.strftime('%Y-%m'))
第二種方法:
df1['period'] = df1['date'].dt.to_period('M')
第二種方法使用起來更加簡單,參數(shù) M 表示月份,Q 表示季度,A 表示年度,D 表示按天,這幾個(gè)參數(shù)比較常用。
新增了一列之后,做出數(shù)據(jù)透視表:
import numpy as np pivot = pd.pivot_table(df1, index=['sku'], columns=['period'], values=['ext price'], aggfunc=np.sum) pivot.head()
再做一個(gè)按季度統(tǒng)計(jì)的數(shù)據(jù)透視表:
df1['quarter'] = df1['date'].dt.to_period('Q') quarter_pivot = pd.pivot_table(df1, index=['sku'], columns=['quarter'], values=['ext price'], aggfunc=np.sum)
參考
Time Series / Date functionality
Extracting just Month and Year from Pandas Datetime column
以上就是本文的全部內(nèi)容,希望對(duì)大家的學(xué)習(xí)有所幫助,也希望大家多多支持腳本之家。
相關(guān)文章
python實(shí)現(xiàn)柵欄加解密 支持密鑰加密
這篇文章主要為大家詳細(xì)介紹了python實(shí)現(xiàn)柵欄加解密,支持密鑰加密,具有一定的參考價(jià)值,感興趣的小伙伴們可以參考一下2019-03-03python3實(shí)現(xiàn)mysql導(dǎo)出excel的方法
這篇文章主要介紹了python3實(shí)現(xiàn)mysql導(dǎo)出excel的方法,本文通過實(shí)例代碼給大家介紹的非常詳細(xì),具有一定的參考借鑒價(jià)值 ,需要的朋友可以參考下2019-07-07Django讀取Mysql數(shù)據(jù)并顯示在前端的實(shí)例
今天小編就為大家分享一篇Django讀取Mysql數(shù)據(jù)并顯示在前端的實(shí)例,具有很好的參考價(jià)值,希望對(duì)大家有所幫助。一起跟隨小編過來看看吧2018-05-05如何用VScode配置Python開發(fā)環(huán)境
這篇文章主要介紹了如何用VScode配置Python開發(fā)環(huán)境,vscode有很多優(yōu)點(diǎn),用VScode來編寫Python,也是相當(dāng)?shù)暮糜玫?需要的朋友可以參考下2023-03-03Python設(shè)計(jì)模式之裝飾模式實(shí)例詳解
這篇文章主要介紹了Python設(shè)計(jì)模式之裝飾模式,結(jié)合實(shí)例形式詳細(xì)分析了裝飾模式的概念、原理并結(jié)合Python實(shí)例形式分析了裝飾模式的相關(guān)使用技巧,需要的朋友可以參考下2019-01-01