Pandas实现按组统计DataFrame时间范围内关联行数
问题说明
现有如下DataFrame:
ID GROUP DATE_MIN DATE_MAX 1 L1 02/12/2022 6:30AM 02/12/2022 6:35AM 2 L1 02/12/2022 6:33AM 02/12/2022 6:40AM 3 L1 02/12/2022 6:37AM 02/12/2022 6:40AM 4 L2 02/12/2022 7:30AM 02/12/2022 7:35AM 5 L2 02/12/2022 7:33AM 02/12/2022 7:35AM 6 L2 02/12/2022 7:34AM 02/12/2022 7:38AM
需求
按GROUP列分组,统计每一行的DATE_MIN至DATE_MAX时间范围内,同组中与该行时间区间存在重叠的行数(包含自身),最终输出需新增NumberOfRows列展示统计结果。
期望输出
ID GROUP DATE_MIN DATE_MAX NumberOfRows 1 L1 02/12/2022 6:30AM 02/12/2022 6:35AM 2 <<因为包含ID 1和2>> 2 L1 02/12/2022 6:33AM 02/12/2022 6:40AM 3 <<因为包含ID 1、2和3>> 3 L1 02/12/2022 6:37AM 02/12/2022 6:40AM 2 <<因为包含ID 3和2>> 4 L2 02/12/2022 7:30AM 02/12/2022 7:35AM 1 <<仅包含ID4>> 5 L2 02/12/2022 7:36AM 02/12/2022 7:40AM 2 <<因为包含ID5和6>> 6 L2 02/12/2022 7:37AM 02/12/2022 7:40AM 2 <<因为包含ID5和6>>
内容的提问来源于stack exchange,提问作者python_interest
相关产品推荐
相关产品推荐

