可观测学堂

可观测技术指南

从概念、接入到生产治理,提供可执行、可验证的工程方法。

用 Grafana 为 Prometheus 创建仪表盘:新手指南 cover
技术指南

用 Grafana 为 Prometheus 创建仪表盘:新手指南

Grafana + Prometheus 可视化入门:部署 Grafana、配置数据源、创建时序图与仪表图、用变量做动态筛选、导入社区仪表盘模板,一篇上手。

Prometheus Relabeling 完全指南 cover
技术指南

Prometheus Relabeling 完全指南

Relabeling 是 Prometheus 最强大也最难懂的功能:在抓取前重写目标标签。

用 Prometheus 监控 Go 应用:埋点实战 cover
技术指南

用 Prometheus 监控 Go 应用:埋点实战

Go 应用接入 Prometheus 的完整教程:prometheus/client_golang 暴露 /metrics、Counter/Gauge/Histogram 三种指标埋点、中间件统一采集 HTTP 指标、常见问题。

Prometheus 最佳实践:八条军规 cover
技术指南

Prometheus 最佳实践:八条军规

Prometheus 八条最佳实践:命名规范、警惕高基数标签、追踪总量与失败量、PromQL 加作用域、告警加容忍时间、处理指标缺失、保留关键标签、规划扩容路径。

用 Alertmanager 做好告警管理:分组、路由、静默与抑制 cover
技术指南

用 Alertmanager 做好告警管理:分组、路由、静默与抑制

Alertmanager 是 Prometheus 告警体系的调度中枢:分组降噪、按标签路由、静默窗口、告警抑制。核心概念与完整配置示例,附通知模板定制方法。

用 Prometheus 监控 Python 应用:新手实战 cover
技术指南

用 Prometheus 监控 Python 应用:新手实战

Python 应用接入 Prometheus:prometheus-client 库安装、/metrics 端点暴露、Counter/Gauge/Histogram 埋点、Flask/FastAPI 中间件集成与生产注意事项。

PHP 与 Laravel 应用接入 Prometheus 监控 cover
技术指南

PHP 与 Laravel 应用接入 Prometheus 监控

PHP/Laravel 接入 Prometheus 监控:promphp/prometheus_client_php 客户端、Counter/Gauge/Histogram 埋点、存储后端选择(Redis/APCu)、Laravel…

Java 应用接入 Prometheus 监控(Spring Boot 实战) cover
技术指南

Java 应用接入 Prometheus 监控(Spring Boot 实战)

Spring Boot 接入 Prometheus:Micrometer + Actuator 暴露 /actuator/prometheus、JVM 默认指标解读、Counter/Gauge/Timer 自定义埋点与生产配置要点。

Ruby on Rails 接入 Prometheus 监控 cover
技术指南

Ruby on Rails 接入 Prometheus 监控

Rails 应用接入 Prometheus:prometheus-client gem、Rack 中间件暴露 /metrics、Counter/Gauge/Histogram 埋点、Puma 多进程模式的数据聚合问题与解决方案。

用 Helm 在 Kubernetes 上部署 Prometheus cover
技术指南

用 Helm 在 Kubernetes 上部署 Prometheus

Helm 部署 Prometheus 到 K8s 全流程:添加仓库、安装 chart、values 定制(持久化、保留期、资源)、kube-prometheus-stack 全家桶方案与生产注意事项。

用 Helm 在 Kubernetes 上部署 Grafana cover
技术指南

用 Helm 在 Kubernetes 上部署 Grafana

Helm 部署 Grafana 到 K8s:grafana chart 安装、持久化配置、数据源与仪表盘的 provisioning、Ingress 暴露与安全注意事项。

AWS Lambda 指标监控完全指南 cover
技术指南

AWS Lambda 指标监控完全指南

Lambda 核心指标详解:调用量、错误、并发、Duration 与冷启动 Init Duration、内存利用率、节流与迭代器延迟;每个指标的含义、告警建议与优化方向。