如何在webhook.site使用XPath提取原始邮件content-type:text/plain上方的Subject头
邮件Subject字段提取方案
1. XPath提取路径(适用webhook.site页面DOM提取场景)
webhook.site默认将收到的原始邮件内容放在页面的<pre><code>标签下,单行Subject的提取XPath如下:
substring-after(//pre/code/text()[contains(., 'Subject: ')], 'Subject: ')
注意:该方案仅适配单行Subject场景,你提供的样例中Subject存在跨行折行,XPath对跨行纯文本匹配支持有限,更推荐使用下方的正则提取方案。
2. 稳定通用提取方案(推荐,兼容跨行场景)
由于邮件头允许Subject字段折行,用正则提取适配性更强,无论在webhook.site自定义操作还是后续数据处理中都可以使用:
- 匹配正则:
Subject: ([\s\S]*?)(?=\n\w+:) - 规则说明:匹配
Subject:开头,到下一个标准邮件头(行首为[字母+冒号]格式)之间的所有内容,自动识别折行的Subject内容。
如果在webhook.site中配置自动提取,操作步骤如下:
- 进入对应webhook.site接收地址的管理页,点击顶部「Custom Actions」
- 新建触发规则,触发条件选择「When a new request is received」
- 动作类型选择「Extract data from request」
- 提取源选择「Raw content」,提取方式选正则匹配,填入上述正则,取第1个分组结果即可得到纯Subject值。
3. 样例提取结果
用你提供的原始邮件测试,提取结果如下:
Ylopo Priority Alert - Party: Daniel Askew 19293 -
PRIORITY_LEAD_EVENT - massaquoimartha@yahoo.com - 8562838525
内容的提问来源于stack exchange,提问作者Jeff Moore
相关产品推荐
相关产品推荐

