Stata中matchit模糊匹配后按规则筛选观测值的方法
Stata模糊匹配后的数据处理需求
我正在使用Stata的matchit命令进行模糊匹配,匹配后得到如下数据:
| 标识符(Identifier) | Variable B | Variable C | 相似度得分(Similarity Score) |
|---|---|---|---|
| 1 | A | X | 0.4 |
| 1 | A | Y | 0.6 |
| 1 | A | Z | 1 |
| 1 | B | Y | 0.2 |
| 1 | B | X | 0.7 |
| 1 | B | Z | 0.8 |
我需要对上述数据做如下处理:
- 为每个唯一的Variable B保留相似度得分最高的行
- 例外规则:如果两个不同的Variable B的最优匹配指向同一个Variable C条目,且其中一个的相似度得分为1,则需保留该Variable B对应的相似度得分第二高的行
最终目标表格如下:
| 标识符(Identifier) | Variable B | Variable C | 相似度得分(Similarity Score) |
|---|---|---|---|
| 1 | A | Z | 1 |
| 1 | B | X | 0.7 |
内容的提问来源于stack exchange,提问作者Samira
相关产品推荐
相关产品推荐

