如何使用Bash提取下载页首个匹配正则的下载链接并完成下载
实现方案
因为GitHub Releases页面内的下载链接是相对路径(示例为href="/sharkdp/bat/releases/download/xxx"),没有直接给出完整https://开头的链接,所以我们可以先提取相对路径再拼接域名得到完整下载地址,完整实现代码如下:
URL=https://github.com/sharkdp/bat/releases/ content=$(wget $URL -q -O -) # 提取首个匹配的amd64 deb包相对路径,拼接为完整链接 DL="https://github.com$(echo "$content" | grep -oP '(?<=href=")/sharkdp/bat/releases/download/[^"]+_amd64\.deb' | head -n 1)" # 下载到/tmp目录 wget -P /tmp/ "$DL"
命令说明
grep -P:启用Perl正则语法,支持零宽断言特性(?<=href="):零宽后向断言,只匹配href="之后的内容,不会把href="本身提取到结果中[^"]+:匹配除双引号外的所有字符,确保只匹配单个链接的路径,不会跨链接错误匹配head -n 1:取匹配结果的第一行,也就是最新版本对应的下载路径- 路径前拼接
https://github.com即可得到可直接访问的完整下载链接
如果你的环境不支持grep的-P参数,可以用sed实现相同效果:
DL="https://github.com$(echo "$content" | sed -n 's/.*href="\(\/sharkdp\/bat\/releases\/download\/[^"]*_amd64\.deb\)".*/\1/p' | head -n 1)"
内容的提问来源于stack exchange,提问作者YorSubs
相关产品推荐
相关产品推荐

