如何从PDF提取半结构化表格?含pdfplumber替代方案及跨页处理
Markdown格式规范
标题(Headings)
使用#号表示标题层级,#数量越多层级越低,最多支持6级:
- 一级标题
二级标题
三级标题
四级标题
五级标题
六级标题
列表(Lists)
无序列表
用短横线-作为列表项开头,支持嵌套:
- 第一列表项
- 第二列表项
- 嵌套子列表项1
- 嵌套子列表项2
有序列表
用数字加.作为列表项开头,支持嵌套:
- 第一有序项
- 第二有序项
- 嵌套有序子项1
- 嵌套有序子项2
文本强调
- 斜体:用单个星号
*包裹文本,例如:这是斜体文本 - 加粗:用两个星号
**包裹文本,例如:这是加粗文本 - 加粗斜体:用三个星号
***包裹文本,例如:这是加粗斜体文本
代码与命令
- 行内代码:用单个反引号
`包裹,例如:print("Hello World") - 代码块:用三个反引号
```包裹,可指定语言实现语法高亮:
def hello(): print("Hello World")
引用文本
用大于号>包裹引用内容,支持多层嵌套:
这是一级引用内容
这是嵌套的二级引用内容
链接
格式为[链接显示文本](链接地址),例如:示例链接
图片
格式为[图片替代文本](图片地址),例如:示例图片
内容的提问来源于stack exchange,提问作者Alex
相关产品推荐
相关产品推荐

