如何基于两列的最小值对Pandas DataFrame进行排序?
按两列最小值排序的解决方案
你可以通过两种方式实现按col1和col2的最小值排序:
方法一:生成临时列排序
先计算每行col1和col2的最小值,生成临时列后按该列排序,完成后可删除临时列:
import pandas as pd d = {'col1': [1, 2,3,4], 'col2': [4, 2, 1, 3], 'col3': [1,0,1,1], 'outcome': [1,0,1,0]} df = pd.DataFrame(data=d) # 生成每行col1和col2的最小值列 df['min_col'] = df[['col1', 'col2']].min(axis=1) # 按最小值列排序 sorted_df = df.sort_values(by='min_col').drop(columns='min_col') print(sorted_df)
输出后的索引顺序就是你期望的2、0、1、3。
方法二:使用sort_values的key参数(更简洁)
不用生成临时列,直接通过key参数指定排序依据为两行的最小值:
import pandas as pd d = {'col1': [1, 2,3,4], 'col2': [4, 2, 1, 3], 'col3': [1,0,1,1], 'outcome': [1,0,1,0]} df = pd.DataFrame(data=d) # 直接按col1和col2的最小值排序 sorted_df = df.sort_values(key=lambda x: x[['col1', 'col2']].min(axis=1)) print(sorted_df)
这个方法更高效,无需额外列操作,同样能得到目标排序结果。
内容的提问来源于stack exchange,提问作者Tox
相关产品推荐
相关产品推荐

