Pandas-分组函数和分层索引的展开

分组函数groupby

在处理数据的时候经常会用到分组,类似于SQL中的group by,按照group by后面接的字段来分成组,之后再进行其他处理。

Pandas中内置了类似的方法,用法简要如下:

df_test = pd.DataFrame(df.groupby(['Pclass','Embarked']).count())

这个意思就是,按照Pclass和Embarked两列取笛卡尔积为组别,然后针对每一组计数。


结果

可以看到,用两列分组的话,出来的索引是分层的。

接下来,用
df_test.index = df_test.index.ravel()
该函数是将拼合的基础数据作为 ndarray 返回。
这里,index就是一组Series,那么正好能返回一个ndarray,把这个ndarry作为index即可。

分层索引合并
©著作权归作者所有,转载或内容合作请联系作者
【社区内容提示】社区部分内容疑似由AI辅助生成,浏览时请结合常识与多方信息审慎甄别。
平台声明:文章内容(如有图片或视频亦包括在内)由作者上传并发布,文章内容仅代表作者本人观点,简书系信息发布平台,仅提供信息存储服务。

相关阅读更多精彩内容

友情链接更多精彩内容