如何从带名称的富文本链接中提取纯文本URL地址
提取带名称链接中的纯URL方法
1. 用Excel/Google Sheets批量处理
如果链接在表格单元格里,直接用公式提取:
- Excel:假设目标链接在A1单元格,输入公式:
=FILTERXML("<a>"&A1&"</a>","//@href")
下拉填充即可批量提取所有URL。 - Google Sheets:用正则提取公式,同样假设链接在A1:
=REGEXEXTRACT(A1, "href=""([^""]+)""")
如果复制过来的是可点击的富文本链接,先右键单元格选择“粘贴为值”,或粘贴时选“只保留文本”,转成带HTML标签的文本再用公式。
2. 用Python脚本批量处理
适合大量链接的批量提取,用正则匹配:
import re # 替换成你自己的链接列表 raw_links = [ '<a href="https://example.com">示例站点</a>', '<a href="https://test-page.net">测试页面</a>' ] # 匹配URL的正则表达式 url_regex = re.compile(r'href="([^"]+)"') for link in raw_links: result = url_regex.search(link) if result: print(result.group(1))
3. 用文本编辑器正则替换(VS Code/Notepad++)
如果链接是纯文本格式,用正则替换一步搞定:
- 打开查找替换功能,勾选「正则表达式」模式
- 查找内容:
.*href="([^"]+)".* - 替换内容:
$1 - 点击「全部替换」,就能得到纯URL列表
如果你的链接是「链接名称 https://xxx.com」这种非HTML格式,把查找内容改成.*(https?://\S+),替换内容还是$1即可。
内容的提问来源于stack exchange,提问作者Kherel
相关产品推荐
相关产品推荐

