Stata纵向数据集:生成RecordID重复次数变量的方法咨询
Stata生成每个ID的总重复次数
你之前用的 bysort RecordID : gen repeat_no = _n 是生成组内的顺序编号(比如同一个ID下会依次生成1、2、3...),而要得到每个ID的总重复次数(即该ID对应的观测总数),需要用内置变量 _N 替代 _n,正确代码如下:
bysort RecordID : gen total_repeats = _N
_N 在 bysort 分组后,代表当前分组(同一个RecordID)的总观测数。运行这段代码后,同一个RecordID的所有行都会被赋予该ID的总重复次数——比如某个RecordID有5条记录,这5条记录的total_repeats值都会是5,正好对应你需要的总重复次数。
内容的提问来源于stack exchange,提问作者Ram Thiru
相关产品推荐
相关产品推荐

