如何用NLP从格式不一的PDF中提取薪资并生成Pandas DataFrame?
Markdown 格式化规范
- 标题:使用数字符号
#定义,层级对应#的数量(1-6个),例如# 一级标题、### 三级标题 - 列表项:以短横线
-作为起始标记,支持嵌套:- 一级列表项
- 嵌套列表项
- 一级列表项
- 文本强调:用星号
*包裹内容,单星号实现斜体(*斜体内容*),双星号实现粗体(**粗体内容**) - 代码/命令:单行内容用单个反引号
`包裹,多行代码块用三个反引号包裹并可指定语言:npm install - 引用文本:在段落前添加大于号
>,支持多级引用:一级引用
二级引用
- 链接:格式为
[显示文本](目标URL),例如[示例链接](https://example.com) - 图片:格式为
[图片描述](图片URL),例如[示例图片](https://example.com/image.png)
相关产品推荐
相关产品推荐

