You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何在Azure Logic App中按行解析邮件文本并提取多字段信息?

Azure Logic App 提取固定格式多行邮件内容方案

问题场景

配置了Azure Logic App读取表单提交的邮件,已经搞定拉取邮件并转成文本,但没法访问表单结果的存储位置。单个字段能通过存变量再拆分提取,但不知道怎么处理这种固定格式的多行文本,邮件格式如下:

Date: 08/18/2022
Time: 09:30:00
Requestor Name: Robert Bobson
Requestor Email: bob@companyname.com
Requestor Phone Number: 800-867-5309
Site Name: CompanyName
Site Number: 123456789

想知道能不能通过行索引提取整行后拆分赋值给变量,要不要用正则,或者Azure Logic App有没有现成的表达式替代方案?


解决方案

1. 行索引拆分法(最推荐,格式固定时最直观)

因为邮件每行对应一个固定字段,直接把文本拆成行数组,按索引取行再拆分键值就行:

  • 先把转换后的邮件文本存入变量(比如命名为EmailContent)
  • 用split(variables('EmailContent'), '\n')把文本拆成每行一个元素的数组
  • 按索引取目标行:比如Date是第0行,Requestor Name是第2行(索引从0开始,根据实际换行情况调整)
  • 拆分键值对:用split(目标行内容, ': '),取索引1的元素就是对应值

示例表达式:

// 拆分所有行为数组
split(variables('EmailContent'), '\n')

// 直接提取Requestor Name的值
split(split(variables('EmailContent'), '\n')[2], ': ')[1]

2. 内置表达式组合提取

用substring()+indexOf()定位字段的起始和结束位置,直接截取值,适合不想拆分数组的场景:
比如提取Requestor Email的表达式:

substring(
  variables('EmailContent'),
  indexOf(variables('EmailContent'), 'Requestor Email: ') + length('Requestor Email: '),
  indexOf(variables('EmailContent'), '\n', indexOf(variables('EmailContent'), 'Requestor Email: ')) - (indexOf(variables('EmailContent'), 'Requestor Email: ') + length('Requestor Email: '))
)

原理:先找到字段标签的位置,加上标签长度得到值的起始点,再找到该行的换行符作为结束点,用substring截取中间内容。

3. 正则表达式提取

如果后续字段格式可能有变化,或者想更灵活匹配,用regexMatch()配合replace()提取:
比如提取Site Number的值:

replace(
  regexMatch(variables('EmailContent'), 'Site Number: (.*)'),
  'Site Number: ',
  ''
)

或者拆分后取值:

split(regexMatch(variables('EmailContent'), 'Site Number: .*'), ': ')[1]

总结

优先用行索引拆分法,格式固定的情况下最容易维护;内置表达式适合不需要拆分数组的场景;正则法则应对更复杂的匹配需求。

内容的提问来源于stack exchange,提问作者yutingxiang

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.22 03:24:38