You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何使用Python读取文本文件并识别其中的email地址

核心问题解答

不需要额外将读取到的内容转换为字符串类型,Python中文件对象的read()方法默认返回的就是完整的文件内容字符串,可直接用于后续的邮箱识别逻辑。

现有代码优化建议

你当前的写法存在未手动关闭文件的资源泄漏风险,推荐使用上下文管理器with操作文件,它会自动执行文件关闭逻辑:

with open("FILE_PATH_HERE", "r", encoding="utf-8") as file:
    content = file.read()
# 出with代码块后文件会自动关闭

邮箱识别实现参考

要从文本中提取邮箱地址,可以用正则匹配完成,完整示例代码如下:

import re

# 通用邮箱匹配正则规则
EMAIL_REGEX = r'\b[A-Za-z0-9._%+-]+@[A-Za-z0-9.-]+\.[A-Z|a-z]{2,}\b'

with open("FILE_PATH_HERE", "r", encoding="utf-8") as f:
    # 直接获取字符串格式的文件内容
    file_content = f.read()

# 提取所有符合规则的邮箱地址
valid_emails = re.findall(EMAIL_REGEX, file_content)
print("识别到的邮箱列表:", valid_emails)

补充说明

如果你的文件体积很大,不建议一次性用read()读取全部内容,可以改用readlines()逐行读取匹配,降低内存占用。

内容的提问来源于stack exchange,提问作者stackoverflown123456

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.10.04 20:54:03