Python : Pandas pivot table for multiple columns at once which has duplicate values(Python:一次包含重复值的多个列的 Pandas 数据透视表)
本文介绍了Python:一次包含重复值的多个列的 Pandas 数据透视表的处理方法,对大家解决问题具有一定的参考价值,需要的朋友们下面随着小编来一起学习吧!
问题描述
有一个包含名称、学校和标记列的 pandas 数据框
have a pandas dataframme with columns name , school and marks
name school marks
tom HBS 55
tom HBS 55
tom HBS 14
mark HBS 28
mark HBS 19
lewis HBS 88
如何转置和转换成这样的
How to transpose and convert into like this
name school marks_1 marks_2 marks_3
tom HBS 55 55 14
mark HBS 28 19
lewis HBS 88
试过这个:
df = df.pivot_table(index='name', values='marks', columns='school')
.reset_index()
.rename_axis(None, axis=1)
print(df)
df = df.pivot('name','marks','school')
检查了这些链接
https://stackoverflow.com/questions/22798934/pandas-long-to-wide-reshape-by-two-variables
https://stackoverflow.com/questions/62391419/pandas-group-by-and-convert-rows-into-multiple-columns
https://stackoverflow.com/questions/60698109/pandas-multiple-rows-to-single-row-with-multiple-columns-on-2-indexes
由于重复值而出现此错误.如果存在重复如何处理,我们必须保留它们
getting this error due to duplicate values. how to handle if duplicate exists and we have to keep them
ValueError: Index contains duplicate entries, cannot reshape
推荐答案
尝试使用 set_index
和 unstack
与 groupby
和 cumcount
:
Try using set_index
and unstack
with groupby
and cumcount
:
df_out = df.set_index(['name',
'school',
df.groupby(['name','school'])
.cumcount() +1]).unstack()
df_out.columns = [f'{i}_{j}' for i, j in df_out.columns]
df_out = df_out.reset_index()
df_out
输出:
name school marks_1 marks_2 marks_3
0 lewis HBS 88.0 NaN NaN
1 mark HBS 28.0 19.0 NaN
2 tom HBS 55.0 55.0 14.0
这篇关于Python:一次包含重复值的多个列的 Pandas 数据透视表的文章就介绍到这了,希望我们推荐的答案对大家有所帮助,也希望大家多多支持编程学习网!
沃梦达教程
本文标题为:Python:一次包含重复值的多个列的 Pandas 数据透视表


基础教程推荐
猜你喜欢
- 在 Python 中,如果我在一个“with"中返回.块,文件还会关闭吗? 2022-01-01
- 筛选NumPy数组 2022-01-01
- 使用PyInstaller后在Windows中打开可执行文件时出错 2022-01-01
- 线程时出现 msgbox 错误,GUI 块 2022-01-01
- 用于分类数据的跳跃记号标签 2022-01-01
- 何时使用 os.name、sys.platform 或 platform.system? 2022-01-01
- 如何让 python 脚本监听来自另一个脚本的输入 2022-01-01
- Python kivy 入口点 inflateRest2 无法定位 libpng16-16.dll 2022-01-01
- Dask.array.套用_沿_轴:由于额外的元素([1]),使用dask.array的每一行作为另一个函数的输入失败 2022-01-01
- 如何在海运重新绘制中自定义标题和y标签 2022-01-01