按唯一姓名获取表多列MIN/MAX值满足单列条件 自动生成工作表统计儿童体测数据
解决方案
方案1:使用Excel Power Query(适合无代码基础用户)
- 打开原表格后,依次点击
数据>从表格/区域,将整张表导入Power Query编辑器,加载时勾选我的表格有标题 - 先删除无关列,仅保留
儿童姓名、腰围、运动完成次数、体重四个核心字段 - 统计每个儿童的最大腰围:点击
分组依据,分组列选儿童姓名,新列名输入最大腰围值,操作选最大值,列选腰围 - 筛选运动次数总和大于2的记录:再次点击
分组依据,分组列选儿童姓名,添加2个聚合规则:- 第一个:新列名
总运动次数,操作选求和,列选运动完成次数 - 第二个:新列名
关联记录,操作选所有行
- 第一个:新列名
- 筛选
总运动次数> 2的行,展开关联记录列,保留体重、腰围字段 - 再次分组统计范围:对同一姓名的记录,聚合得到
体重范围(用最小值和最大值拼接,公式示例:Text.From(List.Min([体重])) & "-" & Text.From(List.Max([体重])))、符合条件的腰围范围(同理拼接腰围的最小值和最大值) - 两个统计结果按
儿童姓名合并后,点击关闭并上载至,选择新工作表即可生成结果,后续原表数据更新后只需右键刷新新表就能同步统计值。
方案2:使用Python Pandas(适合数据量较大、有代码基础的用户)
首先安装依赖:pip install pandas openpyxl
运行以下代码即可自动生成结果:
import pandas as pd # 替换为你的本地文件路径和原工作表名 df = pd.read_excel("你的文件路径.xlsx", sheet_name="原工作表名") # 1. 统计每个儿童的最大腰围 max_waist = df.groupby("儿童姓名")["腰围"].max().reset_index(name="最大腰围值") # 2. 筛选总运动次数大于2的儿童的所有记录 df["总运动次数"] = df.groupby("儿童姓名")["运动完成次数"].transform("sum") filtered_df = df[df["总运动次数"] > 2] # 3. 统计符合条件的体重、腰围范围 range_stats = filtered_df.groupby("儿童姓名").agg( 体重范围=("体重", lambda x: f"{x.min()}-{x.max()}"), 符合条件的腰围范围=("腰围", lambda x: f"{x.min()}-{x.max()}") ).reset_index() # 4. 合并结果写入新工作表 result = pd.merge(max_waist, range_stats, on="儿童姓名", how="left") with pd.ExcelWriter("你的文件路径.xlsx", mode="a", if_sheet_exists="replace") as writer: result.to_excel(writer, sheet_name="统计结果", index=False)
- 代码运行后会直接在原Excel文件中新增名为
统计结果的工作表,所有统计结果自动生成。
内容的提问来源于stack exchange,提问作者Bárbara
相关产品推荐
相关产品推荐

