Azure Log Analytics本地服务器基础监控性能计数器选型咨询
Azure Log Analytics 对接Windows服务器基础监控必选性能计数器清单
不用在数千个可选性能计数器里挨个筛选,下面是生产环境通用的基础监控最小必选清单,覆盖CPU、内存、磁盘核心运行状态维度,无冗余指标,可有效控制Log Analytics采集存储成本:
CPU 监控
Processor(_Total)\% Processor Time:CPU整体使用率,持续高于85%需触发预警System\Processor Queue Length:CPU等待调度队列长度,持续值超过服务器CPU总核心数2倍时,说明CPU算力存在瓶颈Processor Information(_Total)\% Privileged Time:内核态CPU占用占比,持续高于30%通常代表驱动、系统级服务存在异常Process(*)\% Processor Time:单进程CPU占用率,故障场景下用于定位具体高资源消耗进程
内存(RAM)监控
Memory\Available MBytes:剩余可用物理内存,数值低于总内存10%时需排查内存占用异常问题Memory\% Committed Bytes In Use:已提交内存占总内存比例,持续高于80%需警惕内存泄漏风险Memory\Pages/sec:内存与磁盘间的换页速率,持续高于1000说明物理内存不足,正在频繁调用磁盘虚拟内存兜底Process(*)\Private Bytes:单进程私有内存占用量,用于定位内存泄漏的具体进程
磁盘监控
LogicalDisk(*)\% Free Space:单盘符剩余空间占比,建议配置阈值:系统盘剩余低于10%、数据盘剩余低于20%时触发告警LogicalDisk(*)\Avg. Disk sec/Read:逻辑盘平均读延迟,持续高于20ms说明读性能存在瓶颈,高于50ms属于严重性能故障LogicalDisk(*)\Avg. Disk sec/Write:逻辑盘平均写延迟,阈值与读延迟一致LogicalDisk(*)\Current Disk Queue Length:逻辑盘IO等待队列长度,持续高于2说明磁盘IO存在瓶颈PhysicalDisk(*)\Avg. Disk sec/Read、PhysicalDisk(*)\Avg. Disk sec/Write:物理磁盘层面读写延迟,用于区分性能问题来自磁盘硬件还是逻辑卷配置
可选补充:网络基础监控
Network Interface(*)\Bytes Total/sec:单网卡每秒总收发流量,用于判断是否达到网卡带宽上限TCPv4\Connections Established:当前已建立的TCP连接数,数值突增或突降时需排查服务可用性
配置提示:
- 带
*实例的计数器默认会采集所有对应对象(所有进程、所有盘符、所有网卡)的数据,若不需要全量采集,可在配置时指定需要监控的目标实例,减少无效数据产生- 带
_Total的实例为对应对象的汇总统计值,做整体运行状态监控时必选- 在计数器选择界面,直接将上述计数器全名粘贴到搜索框即可快速定位,无需翻找全量列表
Azure Log Analytics性能计数器配置界面参考
相关官方参考内容可通过微软官方文档站点、Azure门户内置帮助中心搜索以下关键词获取:
- Log Analytics Windows性能计数器配置步骤
- Windows Server 基础监控性能计数器最佳实践
- Azure Monitor 性能计数器采集成本优化指南
内容的提问来源于stack exchange,提问作者Thomas Segato
相关产品推荐
相关产品推荐

