可观测学堂

可观测问答

聚焦概念、架构、排障、价格与选型,一篇解决一个明确问题。

如何用 Prometheus 监控 REST API? cover
概念指南

如何用 Prometheus 监控 REST API?

监控 REST API 的两条路径:应用内埋点暴露 /metrics(请求数、延迟、错误率 RED 三指标),或用 blackbox_exporter 从外部探测可用性与响应时间。本文给出两种方案的配置与查询示例。

Docker 容器里的 Prometheus 如何持久化数据? cover
概念指南

Docker 容器里的 Prometheus 如何持久化数据?

Docker 运行 Prometheus 必须挂载数据卷否则容器删除即丢数据:-v prometheus-data:/prometheus 或绑定宿主机目录。本文给出 docker run 与 compose 两种配置、权限问题与备份建议。

如何彻底卸载 Grafana? cover
概念指南

如何彻底卸载 Grafana?

卸载 Grafana 按安装方式区分:apt/yum 包管理器卸载加 purge 清配置、二进制安装直接删目录、Docker 删容器与镜像、 Helm 部署用 helm uninstall。

Grafana 仪表盘如何实现移动平均线(Moving Average)? cover
概念指南

Grafana 仪表盘如何实现移动平均线(Moving Average)?

Grafana 配合 Prometheus 用 avg_over_time 实现移动平均:avg_over_time(rate(metric[1m])[5m:]) 即 5 分钟滑动均值;InfluxDB 用 moving_avera…

如何延长 Prometheus 的数据保留时间(Retention)? cover
概念指南

如何延长 Prometheus 的数据保留时间(Retention)?

Prometheus 默认保留 15 天数据,通过启动参数 --storage.tsdb.retention.time 调整(如 90d),也可按磁盘占用用 retention.size 限制。

InfluxDB vs Prometheus:各自适合什么场景? cover
概念指南

InfluxDB vs Prometheus:各自适合什么场景?

Prometheus 是拉模型监控标准,擅长 K8s/微服务指标与告警;InfluxDB 是通用时序数据库,推模型写入,适合 IoT、高频事件与长保留分析。本文从数据模型、采集方式、查询语言、生态四维度对比并给出选型建议。

Filebeat 提示 "no non-zero metrics in the last 30s" 是什么意思? cover
概念指南

Filebeat 提示 "no non-zero metrics in the last 30s" 是什么意思?

Filebeat 日志出现 "no non-zero metrics in the last 30s" 是信息级提示,表示过去 30 秒没有采集到任何日志数据。本文说明该日志的含义、常见原因(路径配置、权限、无新日志)与排查步骤。

如何用 Helm 在 Kubernetes 上安装 Prometheus 和 Grafana? cover
概念指南

如何用 Helm 在 Kubernetes 上安装 Prometheus 和 Grafana?

用 kube-prometheus-stack 一条 Helm 命令即可在 K8s 上装齐 Prometheus + Grafana + Alertmanager + 全套 K8s 采集器。

Prometheus 标签(Label)有哪些限制? cover
概念指南

Prometheus 标签(Label)有哪些限制?

Prometheus 标签的限制包括:标签名需匹配 [a-zA-Z_][a-zA-Z0-9_]*、值可为任意 UTF-8、双下划线前缀保留、组合基数决定性能上限。本文列出全部硬性限制与避免高基数事故的实践。

如何用 Fluentd 监控(采集)整个目录的日志? cover
概念指南

如何用 Fluentd 监控(采集)整个目录的日志?

Fluentd 用 in_tail 配合通配符路径(/var/log/app/*.log)即可监控整个目录,含子目录用 ** 递归。本文给出配置示例、pos_file 作用、logrotate 轮转处理与多文件标签区分技巧。

如何用 Prometheus 监控 K8s Pod 的自定义指标? cover
概念指南

如何用 Prometheus 监控 K8s Pod 的自定义指标?

让 Prometheus 采集 Pod 自定义指标的完整链路:应用暴露 /metrics → Pod 加 prometheus.io/scrape 注解 → Prometheus K8s 服务发现配置 relabel 规则 → 指标…

如何监控 Kubernetes 持久卷(PV)的磁盘用量? cover
概念指南

如何监控 Kubernetes 持久卷(PV)的磁盘用量?

K8s 不直接暴露 PV 用量,但 kubelet 提供 kubelet_volume_stats_used_bytes / capacity_bytes 指标,Prometheus 抓取 kubelet 后即可计算使用率并告警。