在Azure Kubernetes Service中构建含Jaeger与OpenTelemetry Collector的Helm包时,组件收到操作系统终止信号问题求助
在Azure Kubernetes Service中构建含Jaeger与OpenTelemetry Collector的Helm包时,组件收到操作系统终止信号问题求助
各位大佬好!我最近在折腾一个Helm包,目的是给Azure Kubernetes Service(AKS)集群加上链路追踪的能力,这个Helm包里整合了Jaeger和OpenTelemetry Collector两个核心组件。但现在碰到了个棘手的情况——我的这些组件会收到操作系统的终止信号,导致服务突然退出,追踪链路也断了,实在搞不定,来求助大家!
我的Helm包组件配置
1. Jaeger作为Helm依赖
我把Jaeger官方Helm包加做了依赖,配置如下:
dependencies: - name: jaeger version: "3.1.2" repository: "https://jaegertracing.github.io/helm-charts"
2. OpenTelemetry Collector的ConfigMap
这是Collector的配置文件,用来接收OTLP协议的追踪数据,然后转发到Jaeger:
apiVersion: v1 kind: ConfigMap metadata: name: otel-collector-conf labels: app: opentelemetry component: otel-collector-conf data: otel-collector-config: | receivers: otlp: protocols: http: grpc: exporters: otlp/jaeger: endpoint: "http://test-jaeger-collector.traces-dapr-jaeger-01.svc.cluster.local:14268" tls: insecure: true service: pipelines: traces: receivers: [otlp] # List your exporter here. exporters: [otlp/jaeger]
3. OpenTelemetry Collector的Service
我还定义了对应的Service来暴露Collector的端口,不过完整配置暂时没贴全,核心是要让集群内的服务能访问到Collector的OTLP端口。
现在的问题就是,不管是Jaeger还是OpenTelemetry Collector,都会时不时收到操作系统的终止信号(比如SIGTERM),导致服务突然退出。我检查了资源使用情况,集群的CPU和内存都没到阈值,也没有OOMKilled的日志。有没有大佬能给我点排查思路,或者看看我的配置哪里可能有问题呀?
备注:内容来源于stack exchange,提问作者Lion
相关产品推荐
相关产品推荐

