You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Python使用tabula-py遍历PDF提取的DataFrame查找指定列的方法

问题修复与正确实现

你原代码的错误点如下:

  • Python单行注释使用#而非//
  • if判断语句末尾缺少必须的冒号:
  • 判断逻辑错误:你需要校验的是'Section ID'是否属于当前DataFrame的列名,而非取DataFrame的第3个元素做等值比较
  • Python3中print为内置函数,调用时必须携带括号

基础遍历实现

for df in dfs:
    if 'Section ID' in df.columns:
        print(df)
        # 如果需要直接提取该列的值,替换为 print(df['Section ID']) 即可

带索引的遍历实现

如果你需要同时获取符合要求的表格在dfs列表中的位置,可以用enumerate写法:

for table_idx, df in enumerate(dfs):
    if 'Section ID' in df.columns:
        print(f"索引为{table_idx}的表格包含'Section ID'列,内容:")
        print(df)

内容的提问来源于stack exchange,提问作者user1107731

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.09.24 19:06:03