You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何用Python/Pandas将事件数据聚合为国家-年度汇总数据?

用Pandas实现国家-年度维度的恐怖事件数据汇总

核心步骤代码

  1. 导入Pandas并读取数据集
import pandas as pd

# 读取你的数据集(根据实际文件格式调整,比如xlsx用pd.read_excel)
df = pd.read_csv("你的数据集文件名.csv")
  1. 处理缺失值(可选但推荐)
    原始数据中nkill、nwounded、nhostages可能存在空值(NaN),先替换为0避免汇总错误:
df[['nkill', 'nwounded', 'nhostages']] = df[['nkill', 'nwounded', 'nhostages']].fillna(0)
  1. 分组汇总核心代码
    这一步直接实现按国家-年度分组,计算指定字段的年度总数:
# 按国家名称和年份分组,对死亡、受伤、人质字段求和
country_year_data = df.groupby(['country_txt', 'iyear'])[['nkill', 'nwounded', 'nhostages']].sum().reset_index()

代码解释

  • groupby(['country_txt', 'iyear']):指定分组维度为国家名称和年份,确保每个组对应一个国家的某一年
  • [['nkill', 'nwounded', 'nhostages']]:筛选需要汇总的目标字段
  • .sum():对每个分组内的字段值求和,得到该国家该年度的总数
  • .reset_index():将分组用的country_txt和iyear从索引转回普通列,让结果每行对应一个国家-年度组合

结果示例

处理后的数据结构如下(以中文国家名称为例):

country_txtiyearnkillnwoundednhostages
尼日利亚200012250
马里2000593
尼日利亚20018185

内容的提问来源于stack exchange,提问作者taraamcl

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.03 17:01:21