Linux下gunzip解压gz文件失败被识别为HTML文档的解决方法
问题原因
你拿到的根本不是gzip压缩包,是GitHub的文件预览网页:
- 带blob字段的链接是GitHub的网页展示地址,访问返回的是带页面框架、预览组件的HTML内容,不是原始压缩文件
file命令返回HTML document的结果已经直接说明文件格式不符合预期,gunzip自然无法正常解压。
操作步骤
- 先删除错误下载的文件:
rm 1901.gz
- 获取正确的原始文件地址:打开之前的文件预览页面,点击页面上的Raw按钮,此时地址栏显示的就是文件的真实直链。
- 用wget重新下载该直链对应的文件,下载完成后可先执行
file 1901.gz校验,正常的gz文件会返回包含gzip compressed data的检测结果。 - 校验通过后执行解压命令即可:
gunzip 1901.gz
快捷方法
不想开浏览器找Raw按钮的话,直接把你之前用的下载链接路径里的blob字段替换为raw,得到的就是原始文件直链,直接用wget下载即可。
内容的提问来源于stack exchange,提问作者Kusisi Karem
相关产品推荐
相关产品推荐

