You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何用Python Selenium下载JS渲染的无src HTML embed标签中的PDF

下载页面中Embed对应的PDF文件解决方案

方法1:直接使用已知的PDF地址下载

从a.html的代码里可以看到,脚本跳转的PDF地址是pubs/document-238727.PDF,将这个路径与index.html所在的域名拼接成完整URL(比如index.html地址是https://xxx.com/index.html,则PDF完整地址为https://xxx.com/pubs/document-238727.PDF),在浏览器中打开该URL后,右键选择“另存为”即可下载。

方法2:通过浏览器网络面板抓取真实PDF地址

  • 打开浏览器开发者工具(快捷键F12或Ctrl+Shift+I),切换到「网络」标签页
  • 刷新页面,在筛选栏选择「文档」或直接搜索“PDF”,找到名称为document-238727.PDF的请求
  • 右键该请求,选择「复制链接地址」,将复制的URL粘贴到新标签页打开,即可下载PDF

方法3:利用浏览器控制台提取下载链接

如果上述方法无法直接获取URL,可尝试通过控制台操作:

  1. 打开开发者工具的「控制台」标签页
  2. 输入以下代码获取embed元素:
const embed = document.querySelector('iframe').contentDocument.querySelector('embed');
  1. 执行后输入embed.src,如果返回的是Blob URL(类似blob:https://xxx.com/xxxxxx),直接复制该URL到新标签页打开,右键保存即可。

方法4:直接右键PDF预览区域保存

在页面显示的PDF预览区域(即embed对应的区域)右键点击,部分浏览器会直接弹出「保存PDF」或「另存为」选项,选择后即可完成下载。

内容的提问来源于stack exchange,提问作者bcExpt1123

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.05 12:45:24