如何用正则表达式匹配文件路径最后部分以提取PDF文件名
提取PDF文件名的正则解决方案
正确正则表达式
直接使用这个正则表达式:\/([^\/]+)\.pdf
规则拆解
\/:精准匹配路径中的斜杠([^\/]+):核心匹配逻辑,[^\/]表示不匹配任何斜杠字符,+表示匹配至少一个这类字符,这样就能精准捕获最后一个斜杠到.pdf之间的内容——也就是你需要的纯文件名\.pdf:匹配固定的PDF文件后缀
测试验证
针对你提供的示例数据:
/second/path/to/something-4-5_4.pdf,
/path/to/certain/file.pdf
randomnoise,
使用该正则匹配后,会得到如下结果:
- something-4-5_4.pdf
- file.pdf
额外兼容处理
如果你的CSV行末尾带有逗号(比如第一行的,),上述正则依然能正常工作,因为它只聚焦斜杠到.pdf的核心内容,不受行尾多余字符影响。如果需要严格适配带可选逗号的场景,也可以用\/([^\/]+)\.pdf(?:,)?,不过前者已经完全满足需求。
内容的提问来源于stack exchange,提问作者Surcouf
相关产品推荐
相关产品推荐

