用 Docker Compose 整合外部监控看板的核心是:业务容器暴露 Prometheus 指标,通过 cadvisor、node-exporter、Prometheus 和 Grafana 四组件协同采集、存储与可视化,再扩展 Loki/Jaeger 实现日志与链路追踪。
直接用 Docker Compose 整合外部监控看板,核心是让业务容器暴露指标、引入采集器、对接时序数据库、再由 Grafana 渲染。不依赖复杂开发,靠配置就能跑起来。
多数现代应用(如 Spring Boot、Node.js Express、Go Gin)默认支持 Prometheus 格式指标端点,比如 /actuator/prometheus 或 /metrics。确认你的服务已启用该功能,并确保该路径在容器内可被访问。
若服务本身不支持,可加一层轻量 exporter,例如:
nginx-prometheus-exporter 镜像监听 Nginx stub_status,转换为 Prometheus 指标mysqld-exporter,连接数据库拉取慢查询、连接数等指标/metrics
关键点:指标必须能被 Prometheus 主动抓取,即 HTTP 可达、返回文本格式(Content-Type: text/plain),且端口在容器网络中开放。
无需新建文件,直接扩展现有 docker-compose.yml,追加 cadvisor(容器层)、node-exporter(主机层)、prometheus(存储+抓取)、grafana(可视化)四个服务:
/sys、/var/run、/var/lib/docker),监听 :8080/metrics
--path.procfs=/host/proc 等参数适配容器内路径,暴露 :9100/metrics
scrape_configs 配置多个 job,包括业务服务(如 http://web:8080/actuator/prometheus)、cadvisor、node-exporter3000 端口,预置数据源指向 http://prometheus:9090,可挂载初始化仪表盘 JSON 文件所有服务建议共用一个自定义网络(如 monitor_net),避免跨网络 DNS 解析失败。
在 prometheus.yml 中添加 job,重点注意两点:
web:8080),不是 localhost——Docker 内部网络中 localhost 指当前容器自身scrape_interval(如 15s),避免高频抓取拖慢业务服务示例片段:
scrape_configs: - job_name: 'spring-boot-app' static_configs: - targets: ['web:8080'] metrics_path: '/actuator/prometheus'
启动后访问 http://localhost:9090/targets,确认状态为 UP,说明指标已成功接入。
登录 Grafana(默认 admin/admin),完成以下操作即可出图:
http://prometheus:9090(同网络内容器名可达)4701(Spring Boot Actuator)、12654(Node.js Express)、或 1860(通用容器监控)job="prometheus" 改成 job="spring-boot-app"
不需要从零画图。真实业务中,优先关注:HTTP 请求成功率、平均响应时间、JVM 内存使用率、数据库连接池等待数、队列积压量——这些指标直连业务健康度。
监控看板只回答“发生了什么”,配合日志和链路才能定位“为什么”。可在同一 compose 文件中加入:
它们共享网络和 volume,复用 Prometheus 的服务发现机制,形成日志-指标-链路(Logs-Metrics-Traces)三位一体视图。