You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何用Python网页抓取获取选中的章节与卷号信息

Python 提取选中章节的卷号与章节号

可以用BeautifulSoup库处理HTML解析,步骤如下:

1. 安装依赖

如果还没安装BeautifulSoup4,先执行:

pip install beautifulsoup4

2. 实现代码

from bs4 import BeautifulSoup

# 目标HTML内容
html_content = """
<select class="navi-change-chapter">
        <option data-c="24">Vol.4 Chapter 24</option>
        <option data-c="23" selected>Vol.4 Chapter 23</option>
        <option data-c="22">Vol.4 Chapter 22</option>
        <option data-c="21">Vol.4 Chapter 21</option>
        <option data-c="20">Vol.4 Chapter 20</option>
        <option data-c="19">Vol.3 Chapter 19</option>
        <option data-c="18">Vol.3 Chapter 18</option>
        <option data-c="17">Vol.3 Chapter 17</option>
</select>
"""

# 解析HTML
soup = BeautifulSoup(html_content, 'html.parser')

# 定位带有selected属性的<option>标签
selected_option = soup.select_one('option[selected]')

if selected_option:
    # 获取标签文本并去除首尾空格
    text = selected_option.get_text(strip=True)
    # 提取卷号:截取Vol.后的数字部分
    vol_num = text.split('Vol.')[1].split()[0]
    # 提取章节号:截取Chapter后的数字部分
    chapter_num = text.split('Chapter ')[1]
    
    print(f"卷号:{vol_num},章节号:{chapter_num}")
else:
    print("未找到带有selected属性的<option>标签")

代码说明

  • 用select_one('option[selected]')精准定位选中的选项
  • 通过字符串分割提取目标数字,无需依赖正则,简单直观
  • 增加判断逻辑,避免找不到元素时触发报错

内容的提问来源于stack exchange,提问作者Evank

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.21 17:39:53