You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

正则表达式新手求助:如何提取am/pm前的数值(含空格/无空格场景)

解决正则提取时间数字的问题

嘿,我来帮你搞定这个正则问题!你的代码里有个小坑导致匹配失败——Python的re模块不需要用/来包裹正则表达式(那是JavaScript这类语言的写法),另外我们再把正则调整得更严谨一点,就能完美覆盖两种情况了。

修正后的代码示例

import re

# 测试两个目标语句
sentence_without_space = "I have a lunch break at 5am later today."
sentence_with_space = "I have a lunch break at 5 am later today."

# 定义正则模式:匹配1-12的数字,后面可选空格,再跟上am/pm(兼容大小写)
time_pattern = r'([1-9]|1[012]) ?[ap]m'

# 提取数字,加上IGNORECASE适配大写的AM/PM场景
result1 = re.findall(time_pattern, sentence_without_space, flags=re.IGNORECASE)
result2 = re.findall(time_pattern, sentence_with_space, flags=re.IGNORECASE)

print(result1)  # 输出: ['5']
print(result2)  # 输出: ['5']

关键调整点说明

  • 去掉多余的/:Python中直接写正则字符串即可,不需要用斜杠分隔,这是你之前代码失败的核心原因。
  • ?实现可选空格:?表示前面的空格字符出现0次或1次,刚好覆盖“数字和am/pm之间有空格”“无空格”两种场景。
  • r''原始字符串:用原始字符串定义正则,避免Python对正则里的特殊字符进行不必要的转义,让写法更直观。
  • re.IGNORECASE标记:如果你的文本里可能出现AM/PM这种大写形式,这个标记能确保匹配成功;如果确定只有小写,也可以去掉这个参数。

内容的提问来源于stack exchange,提问作者user9148659

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.05.15 06:48:12