Python使用tabula-py遍历PDF提取的DataFrame查找指定列的方法
问题修复与正确实现
你原代码的错误点如下:
- Python单行注释使用
#而非// - if判断语句末尾缺少必须的冒号
: - 判断逻辑错误:你需要校验的是
'Section ID'是否属于当前DataFrame的列名,而非取DataFrame的第3个元素做等值比较 - Python3中
print为内置函数,调用时必须携带括号
基础遍历实现
for df in dfs: if 'Section ID' in df.columns: print(df) # 如果需要直接提取该列的值,替换为 print(df['Section ID']) 即可
带索引的遍历实现
如果你需要同时获取符合要求的表格在dfs列表中的位置,可以用enumerate写法:
for table_idx, df in enumerate(dfs): if 'Section ID' in df.columns: print(f"索引为{table_idx}的表格包含'Section ID'列,内容:") print(df)
内容的提问来源于stack exchange,提问作者user1107731
相关产品推荐
相关产品推荐

