如何用Python编写递归函数遍历文件夹查找CSV文件
解决递归遍历文件夹找CSV文件的问题
我来帮你修正代码里的问题,同时给你两种可行的实现方案——一种是手动写递归函数,另一种是用Python内置的os.walk(更简洁可靠)。
首先先说说你原始代码里的几个关键问题:
loop_folder函数根本没实现递归逻辑,只是写了个空的return def,完全起不到遍历子文件夹的作用get_file_details里重复调用os.listdir,一会儿用DIR_PATH一会儿用.,逻辑混乱,而且没有处理子文件夹的路径传递- 调用
loop_folder()时没传参数,递归根本无法深入到子目录 - 用了Python2的
print entry语法,现在推荐用Python3的print(entry)
方案一:手动实现递归函数
这个方案完全用递归逻辑来遍历,适合理解递归的工作原理:
import os def find_csv_files(folder_path): # 遍历当前文件夹下的所有文件/文件夹 for entry in os.listdir(folder_path): # 拼接出条目的完整路径,避免相对路径出错 full_entry_path = os.path.join(folder_path, entry) # 跳过macOS的.DS_Store隐藏文件 if entry == '.DS_Store': continue # 如果是文件夹,递归调用自身继续遍历 if os.path.isdir(full_entry_path): find_csv_files(full_entry_path) # 如果是CSV文件,打印它的完整路径 elif entry.endswith('.csv'): print(full_entry_path) if __name__ == '__main__': # 获取当前脚本所在的文件夹路径 current_dir = os.path.dirname(os.path.abspath(__file__)) # 从当前文件夹开始遍历 find_csv_files(current_dir)
关键改进点:
- 用
os.path.join拼接完整路径,确保在子文件夹中也能正确定位文件 - 递归调用时传入子文件夹的完整路径,让递归能深入嵌套目录
- 函数职责单一,专门负责遍历和查找CSV文件
- 用
print(full_entry_path)打印完整路径,比只打印文件名更实用
方案二:使用os.walk(更简洁推荐)
Python内置的os.walk已经帮我们实现了递归遍历文件夹的逻辑,代码更简洁,也不容易出错:
import os # 获取当前脚本所在的文件夹路径 current_dir = os.path.dirname(os.path.abspath(__file__)) # os.walk会自动递归遍历所有子文件夹 # root:当前正在遍历的文件夹路径 # dirs:当前文件夹下的子文件夹列表(这里用下划线忽略了) # files:当前文件夹下的文件列表 for root, _, files in os.walk(current_dir): # 过滤掉.DS_Store文件 filtered_files = [file for file in files if file != '.DS_Store'] for file in filtered_files: if file.endswith('.csv'): # 拼接完整路径并打印 print(os.path.join(root, file))
为什么推荐这个方案?
os.walk是Python官方提供的遍历工具,经过充分测试,比自己写递归更稳定- 不需要手动处理递归的终止条件,减少出错概率
- 代码更简洁,可读性更高
内容的提问来源于stack exchange,提问作者ghadah
相关产品推荐
相关产品推荐

