SLO、error budget 和 multi-burn-rate 告警的工程实现,按问答一节节推进:为什么传统阈值告警噪声大或滞后、burn rate 14.4× 和 6× 怎么来的,Prometheus 的 recording rules 与 alert 又怎么写。
Posts for: #observability
Spring Boot 3.5 接 OpenTelemetry:尽量少写手动接入,把四个信号串起来(2026)
Spring Boot 3.5 + Java 25 下的 OpenTelemetry 接入:尽量让自动配置去做,启用虚拟线程,用 JFR 补上 profiles,把 Traces / Metrics / Logs / Profiles 串起来。
K8s CPU 配置:requests/limits 各管什么、Throttling 怎么发生、谁先被驱逐
结合 Homelab 场景整理 Kubernetes 的 CPU requests/limits、CFS throttling、QoS 类别与节点压力驱逐机制,以及我当前采用的资源配置思路。
使用 helm 添加 observability 需要的服务
已经在 homelab 搭建了 microk8s 集群,需要使用 helm 为集群添加 observability 功能,包括 prometheus、grafana、loki 和 tempo 等组件。