You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Stata中将多值变量拆分并匹配对应值的实现方法

Stata拆分分隔变量并转为长格式数据集

针对你提供的数据集,需要将Region和Sales变量按~拆分,让每个区域对应一行销售数据,具体操作步骤如下:

操作代码

* 确保ID为字符串类型(保留前导零)
tostring ID, replace format(%03.0f)

* 按~分隔拆分Region和Sales变量
split Region, parse(~)
split Sales, parse(~)

* 将宽格式转为长格式,匹配对应区域与销售额
reshape long Region Sales, i(ID Product) j(seq)

* 清理无效数据:删除缺失区域或销售额的行
drop if missing(Region) | missing(Sales)

* 将Sales转为数值型(拆分后默认是字符串)
destring Sales, replace

* 调整变量顺序,匹配目标格式
order ID Product Region Sales

* 可选:删除临时生成的序号变量seq
drop seq

代码说明

  • tostring:把ID转为字符串格式,避免前导零丢失(如果你的ID本来就是字符串,这步可以跳过)
  • split:以~为分隔符,将原变量拆分成多个带数字后缀的新变量(比如Region拆成Region1、Region2...)
  • reshape long:把拆分后的多列变量转为行,i(ID Product)指定每组的标识,确保同一ID+Product的所有区域销售额对应展开
  • destring:将拆分后是字符串类型的Sales转为数值,方便后续统计分析
  • order:调整变量顺序,和你想要的目标格式一致

内容的提问来源于stack exchange,提问作者EconNoob

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.06.25 02:55:00