如何使用Python从大文本文件提取含720p的完整MP4 URL
提取符合规则的720p视频URL
问题分析
你需要提取的URL需满足:
- 固定开头:
https://vod-progressive.akamaized.net - 包含关键字
720p - 路径中包含
.mp4且最终以.mp4结尾 - 仅提取符合条件的单条URL
修正后的代码
import re # 读取目标文本文件 with open("你的文件名.txt", "r", encoding="utf-8") as file: text_content = file.read() # 构造精准匹配的正则表达式 url_pattern = r'https://vod-progressive\.akamaized\.net.*?720p.*?\.mp4' # 查找唯一符合条件的URL(若有多个可改用re.findall) result = re.search(url_pattern, text_content) if result: target_url = result.group() print(target_url) else: print("未找到符合要求的URL")
正则规则说明
https://vod-progressive\.akamaized\.net:匹配固定开头,对.转义避免匹配任意字符.*?:非贪婪模式匹配任意字符,防止跳过目标URL直接匹配到文本中后续的无关内容720p:强制匹配关键字,过滤掉不含720p的URL.*?\.mp4:非贪婪匹配到结尾的.mp4,确保获取完整的URL路径
解决原代码问题的关键点
- 加入
720p关键字匹配,直接过滤掉无关URL - 使用非贪婪模式
.*?替代贪婪模式.*,避免URL被提前截断 - 用
re.search替代re.findall(若仅需单条结果),提升效率且直接获取目标URL
内容的提问来源于stack exchange,提问作者computerdentist
相关产品推荐
相关产品推荐

