pythonic生物人

Pandas图解教程,秒懂这些操作!

Pandas读取csv文件

使用pandas的pandas.read_csv函数,读取music.csv文件,存入变量df,此时,df为一个pandas DataFrame。

df = pandas.read_csv('music.csv')
df

pandas.DataFrame取列操作

此处,取第一列数据:

df['Artist']

pandas.DataFrame取行操作

此处,取第二、第三行数据(⚠️注意,df[1:3]不包含左边界):

df[1:3]

pandas.DataFrame取行、列操作

此处,取第一列中,第一、二、第三行数(⚠️注意,df.loc[1:3]包含左边界):

df.loc[1:3,['Artist']]

pandas.DataFrame按条件过滤

取满足Genre列为Jazz的数据:

df[df['Genre'] == "Jazz" ]

取满足Listeners列大于1,800,000的数据:

df[df['Listeners'] > 1800000 ]

pandas.DataFrame处理缺省值NaN

df的Plays列存在一缺省值NaN: 使用dropna丢失包含缺省值的行:

df.dropna()

pandas.DataFrame数据分组

此处,按照Genre分组,汇总每个Genre拥有的Listeners数目和Plays数目:

df.groupby('Genre').sum()

pandas.DataFrame增加新列

增加一列Avg Plays,由Plays列与Listeners列之商而来:

pandas.DataFrame数据重构-pivot

pandas.DataFrame数据重构-melt

pandas.DataFrame数据重构-stack

pandas.DataFrame数据重构-unstack

pandas.DataFrame数据重构-unstack(1)

pandas.DataFrame数据重构-unstack(0)

- END-