如何提取pandas DataFrame指定列的第n大数值(以第二大为例)
Pandas提取DataFrame指定列第二大数值的解决方案
你之前的代码出错是因为调用了to_string()方法将前n行的结果拼接为了多行字符串,自然无法直接转为float类型的单个数值。
方案1:直接提取nlargest返回结果中的第二行值
如果允许第二大数值和最大值相等(即存在重复最大值时直接返回排序后的第二个值),可以直接通过iloc取索引为1的元素即可:
n = 2 largest_ja = narr_df.nlargest(n, columns='Rate_Variance')['Rate_Variance'].iloc[1]
此时返回的largest_ja本身就是浮点型数值,无需额外转换。
方案2:提取去重后的第二大数值
如果需要获取和最大值不相等的、真正的第二档数值,可以先对目标列去重再排序取值:
largest_ja = narr_df['Rate_Variance'].drop_duplicates().sort_values(ascending=False).iloc[1]
可选优化
如果不确定目标列的非重复值数量是否≥2,可以先加一层判断避免索引溢出报错:
unique_rate = narr_df['Rate_Variance'].drop_duplicates() if len(unique_rate) >= 2: largest_ja = unique_rate.sort_values(ascending=False).iloc[1] else: # 自定义不足2个值时的处理逻辑 largest_ja = None
内容的提问来源于stack exchange,提问作者Luke Simpson
相关产品推荐
相关产品推荐

