Pandas图解教程,秒懂这些操作!
Pandas读取csv文件
使用pandas的pandas.read_csv函数,读取music.csv文件,存入变量df,此时,df为一个pandas DataFrame。
df = pandas.read_csv('music.csv')
df
pandas.DataFrame取列操作
此处,取第一列数据:
df['Artist']
pandas.DataFrame取行操作
此处,取第二、第三行数据(⚠️注意,df[1:3]不包含左边界):
df[1:3]
pandas.DataFrame取行、列操作
此处,取第一列中,第一、二、第三行数(⚠️注意,df.loc[1:3]包含左边界):
df.loc[1:3,['Artist']]
pandas.DataFrame按条件过滤
取满足Genre列为Jazz的数据:
df[df['Genre'] == "Jazz" ]
取满足Listeners列大于1,800,000的数据:
df[df['Listeners'] > 1800000 ]
pandas.DataFrame处理缺省值NaN
df的Plays列存在一缺省值NaN:
使用dropna丢失包含缺省值的行:
df.dropna()
pandas.DataFrame数据分组
此处,按照Genre分组,汇总每个Genre拥有的Listeners数目和Plays数目:
df.groupby('Genre').sum()
pandas.DataFrame增加新列
增加一列Avg Plays,由Plays列与Listeners列之商而来:
pandas.DataFrame数据重构-pivot
pandas.DataFrame数据重构-melt
pandas.DataFrame数据重构-stack
pandas.DataFrame数据重构-unstack
pandas.DataFrame数据重构-unstack(1)
pandas.DataFrame数据重构-unstack(0)