You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

XPath条件子选择难题:Python HTML爬虫提取<li>文本遇空<i>标签干扰

嘿,这就把你需要的Markdown格式规范整理得明明白白,附上手示例,一看就会:

Markdown格式使用指南

标题(Headings)

用#来定义标题层级,#的数量越多,标题层级越低(最多支持6级):

  • 一级标题写法:# 我的一级标题 → # 我的一级标题
  • 二级标题写法:## 我的二级标题 → ## 我的二级标题

列表项(List Items)

无序列表直接用破折号-开头,每个列表项单独占一行:

  • 第一条列表内容
  • 第二条列表内容
  • 第三条列表内容

文本强调(Emphasis)

想要突出特定文本?用星号包裹即可:

  • 斜体强调:*这段文本是斜体* → 这段文本是斜体
  • 加粗强调:**这段文本是加粗** → 这段文本是加粗

代码/命令(Code/Commands)

单行代码或命令用单个反引号`包裹,清晰区分普通文本:
python main.py
npm install react

多行代码块可以用三个反引号包裹,还能指定编程语言实现语法高亮:

def parse_html(html):
    from lxml import etree
    tree = etree.HTML(html)
    return tree.xpath('//li/text()')

引用文本(Quoted Text)

用大于号>标记引用内容,嵌套引用可以叠加多个>:

这是一段基础引用文本

这是嵌套在里面的二级引用文本

链接(Links)

格式为[显示文本](目标URL),点击显示文本就能跳转到对应链接:
Markdown语法参考

图片(Images)

用[图片替代文本](图片URL)的格式插入图片,如果需要添加图片标题,可以在URL后加双引号:
海边日落


内容的提问来源于stack exchange,提问作者César Souza Liedke

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.05.26 11:11:08