7.1 Metrics:Prometheus + Grafana
为什么 Kubernetes 需要一套完整的指标体系 Prometheus 在 Kubernetes 中采集指标的常见方式 `ServiceMonitor` 与 `PodMonitor` 的区别与使用场景
阅读全文 →K8s 核心概念到最后故障排查实战
为什么 Kubernetes 需要一套完整的指标体系 Prometheus 在 Kubernetes 中采集指标的常见方式 `ServiceMonitor` 与 `PodMonitor` 的区别与使用场景
阅读全文 →为什么日志采集不能只依赖 `kubectl logs` Loki 与 Promtail 的基本架构和数据流 容器日志如何采集、打标签、检索 如何做留存策略、成本控制与排障实践
阅读全文 →分布式追踪到底解决什么问题 OpenTelemetry 里 `Trace`、`Span`、`Context` 的核心概念 在 Kubernetes 中如何接入 Collector 与应用埋点 指标、日志、追踪如何做关联分析
阅读全文 →Event 是集群中某处发生的一次事件报告。同时官方也提醒,Events 具有有限保留时间,触发条件和消息文本也可能随着时间演化,因此 Event 应被视为“信息性、尽力而为、补充型数据”,而不是长期审计事实源。
阅读全文 →