
Grafana 如何复制(Duplicate)一个仪表盘?
Grafana 复制仪表盘的三种方式:仪表盘设置里 Save As 另存、Dashboard 列表页直接 Duplicate、或导出 JSON 再导入。本文说明各自步骤与注意事项。
聚焦概念、架构、排障、价格与选型,一篇解决一个明确问题。

Grafana 复制仪表盘的三种方式:仪表盘设置里 Save As 另存、Dashboard 列表页直接 Duplicate、或导出 JSON 再导入。本文说明各自步骤与注意事项。

PromQL 没有 SQL 式 JOIN,但可以用算术运算 + on/ignoring 标签匹配,或 group_left/group_right 修饰符把两个指标按标签对齐后合并计算。本文给出对齐计算的完整写法与典型场景。

管理 Prometheus 计数器的要点:命名加 _total 后缀、重启归零用 rate() 自动处理、永远不要手动递减、高基数标签要克制、长期存储靠远端写。本文给出完整实践清单。

监控 REST API 的两条路径:应用内埋点暴露 /metrics(请求数、延迟、错误率 RED 三指标),或用 blackbox_exporter 从外部探测可用性与响应时间。本文给出两种方案的配置与查询示例。

Docker 运行 Prometheus 必须挂载数据卷否则容器删除即丢数据:-v prometheus-data:/prometheus 或绑定宿主机目录。本文给出 docker run 与 compose 两种配置、权限问题与备份建议。

卸载 Grafana 按安装方式区分:apt/yum 包管理器卸载加 purge 清配置、二进制安装直接删目录、Docker 删容器与镜像、 Helm 部署用 helm uninstall。

Grafana 配合 Prometheus 用 avg_over_time 实现移动平均:avg_over_time(rate(metric[1m])[5m:]) 即 5 分钟滑动均值;InfluxDB 用 moving_avera…

Prometheus 默认保留 15 天数据,通过启动参数 --storage.tsdb.retention.time 调整(如 90d),也可按磁盘占用用 retention.size 限制。

Prometheus 是拉模型监控标准,擅长 K8s/微服务指标与告警;InfluxDB 是通用时序数据库,推模型写入,适合 IoT、高频事件与长保留分析。本文从数据模型、采集方式、查询语言、生态四维度对比并给出选型建议。

Filebeat 日志出现 "no non-zero metrics in the last 30s" 是信息级提示,表示过去 30 秒没有采集到任何日志数据。本文说明该日志的含义、常见原因(路径配置、权限、无新日志)与排查步骤。

用 kube-prometheus-stack 一条 Helm 命令即可在 K8s 上装齐 Prometheus + Grafana + Alertmanager + 全套 K8s 采集器。

Prometheus 标签的限制包括:标签名需匹配 [a-zA-Z_][a-zA-Z0-9_]*、值可为任意 UTF-8、双下划线前缀保留、组合基数决定性能上限。本文列出全部硬性限制与避免高基数事故的实践。