Logic Apps Standard诊断日志丢失问题求助及优化建议咨询
背景
我们团队在构建企业集成时大量使用Logic Apps (Standard)。这些集成有时会发送业务关键消息,绝对不能丢失。若偶尔发生消息丢失情况,我们希望能够追踪到相关信息。因此,我们决定配置Diagnostic Settings并在工作流中发送Tracked Properties,随后可通过Alert Rules触发向Action Group的通知等方式进行监控。
问题
我们如今发现大量日志丢失。在预期的22000条日志记录中,约有4000-6000条丢失,从未进入Log Analytics Workspace。这带来了极大困扰,因为我们无法轻松查看工作流处理过的内容;虽然可以查看单个工作流运行记录,但这耗时过长。简言之,我们希望为运维团队提供可靠的日志。
Azure Monitor Resource Logs并非100%无丢失。资源日志基于存储转发架构设计,旨在经济高效地大规模传输每日PB级数据。该功能包含平台内置的冗余和重试机制,但不提供事务保证。
然而,丢失约20%的日志似乎过于严重,尤其是考虑到与Log Analytics可摄入的海量日志相比,当前日志量相对较小。
排查步骤
我们已确认:
- 未对WorkflowRuntimeLogs进行采样。
- Logic Apps未因App Service Plan资源不足而受限。
- 预期的工作流运行已完成,且数据已送达最终目的地。即存在无日志的成功运行情况。
咨询问题
- 是否有其他用户遇到过Diagnostic Settings指向Log Analytics时的类似情况?
- 能否推荐更可靠的替代日志解决方案?
- 我们还可采取哪些额外措施来减少日志丢失?
如需更多信息或说明,我们乐意提供。非常感谢任何见解或建议。
内容的提问来源于stack exchange,提问作者Eric Qvarnström
相关产品推荐
相关产品推荐

