如何用Python Selenium下载JS渲染的无src HTML embed标签中的PDF
下载页面中Embed对应的PDF文件解决方案
方法1:直接使用已知的PDF地址下载
从a.html的代码里可以看到,脚本跳转的PDF地址是pubs/document-238727.PDF,将这个路径与index.html所在的域名拼接成完整URL(比如index.html地址是https://xxx.com/index.html,则PDF完整地址为https://xxx.com/pubs/document-238727.PDF),在浏览器中打开该URL后,右键选择“另存为”即可下载。
方法2:通过浏览器网络面板抓取真实PDF地址
- 打开浏览器开发者工具(快捷键F12或Ctrl+Shift+I),切换到「网络」标签页
- 刷新页面,在筛选栏选择「文档」或直接搜索“PDF”,找到名称为
document-238727.PDF的请求 - 右键该请求,选择「复制链接地址」,将复制的URL粘贴到新标签页打开,即可下载PDF
方法3:利用浏览器控制台提取下载链接
如果上述方法无法直接获取URL,可尝试通过控制台操作:
- 打开开发者工具的「控制台」标签页
- 输入以下代码获取embed元素:
const embed = document.querySelector('iframe').contentDocument.querySelector('embed');
- 执行后输入
embed.src,如果返回的是Blob URL(类似blob:https://xxx.com/xxxxxx),直接复制该URL到新标签页打开,右键保存即可。
方法4:直接右键PDF预览区域保存
在页面显示的PDF预览区域(即embed对应的区域)右键点击,部分浏览器会直接弹出「保存PDF」或「另存为」选项,选择后即可完成下载。
内容的提问来源于stack exchange,提问作者bcExpt1123
相关产品推荐
相关产品推荐

