OpenRefine中Wikidata匹配后如何获取多语言站点链接
在OpenRefine中提取Wikidata实体的多语言站点链接
完全可以通过「从匹配值添加列」功能实现你的需求,以下是具体操作方法:
获取所有多语言站点链接(带分隔符)
- 选中已完成Wikidata匹配的列,点击「编辑列」→「从匹配值添加列」
- 在弹出的配置框中,匹配类型选择「Wikidata」,然后在表达式输入框中填入:
forEach(cell.recon.match.sitelinks, link, link.url).join("; ") - 设置新列名称(比如「所有站点链接」)后确认,就能得到用分号分隔的所有站点链接字符串。
单独提取Meta页面链接
同样用「从匹配值添加列」,表达式改为:
cell.recon.match.sitelinks.find(link, link.site == "metawiki")?.url
这个表达式会筛选出站点标识为metawiki的链接并提取其URL,如果实体没有Meta站点链接,会返回空值。
单独提取Commons页面链接
表达式替换为:
cell.recon.match.sitelinks.find(link, link.site == "commonswiki")?.url
逻辑和Meta链接提取一致,筛选commonswiki标识的站点链接。
额外说明
如果希望每个链接单独占一行(逐个获取),可以先按第一种方法生成带分隔符的链接列,再选中该列点击「编辑列」→「拆分多值列」,选择对应的分隔符即可将单个单元格的多个链接拆分为多行。
内容的提问来源于stack exchange,提问作者silviaegt
相关产品推荐
相关产品推荐

