如何在Pandas中基于两列生成包含连续整数序列的新列
实现方法
你可以通过以下两种方式实现需求,按需选择即可:
方法1:逐行apply实现(逻辑简单,适合中小数据量)
核心是利用range生成左闭右开的整数序列,终止位需要+1才能包含原终止值,再转为列表:
import pandas as pd # 假设你的DataFrame列名为「起始值」和「终止值」,自行替换为你实际的列名即可 df['连续整数列表'] = df.apply(lambda row: list(range(row['起始值'], row['终止值'] + 1)), axis=1)
方法2:向量化实现(性能更高,适合万行以上的大数据表)
避免逐行遍历的开销,运行速度远快于apply方法:
import pandas as pd import numpy as np lens = df['终止值'] - df['起始值'] + 1 val_arr = np.repeat(df['起始值'], lens) offset_arr = np.concatenate([np.arange(n) for n in lens]) df['连续整数列表'] = (val_arr + offset_arr).groupby(level=0).agg(list)
运行上述代码后,新增的连续整数列表列就是你需要的、对应行起止值范围内的连续整数列表。
内容的提问来源于stack exchange,提问作者Madridista
相关产品推荐
相关产品推荐

