
如何用 Fluentd 监控(采集)整个目录的日志?
Fluentd 用 in_tail 配合通配符路径(/var/log/app/*.log)即可监控整个目录,含子目录用 ** 递归。本文给出配置示例、pos_file 作用、logrotate 轮转处理与多文件标签区分技巧。
聚焦概念、架构、排障、价格与选型,一篇解决一个明确问题。

Fluentd 用 in_tail 配合通配符路径(/var/log/app/*.log)即可监控整个目录,含子目录用 ** 递归。本文给出配置示例、pos_file 作用、logrotate 轮转处理与多文件标签区分技巧。

让 Prometheus 采集 Pod 自定义指标的完整链路:应用暴露 /metrics → Pod 加 prometheus.io/scrape 注解 → Prometheus K8s 服务发现配置 relabel 规则 → 指标…

K8s 不直接暴露 PV 用量,但 kubelet 提供 kubelet_volume_stats_used_bytes / capacity_bytes 指标,Prometheus 抓取 kubelet 后即可计算使用率并告警。

在 static_configs 中按 targets 分组配置 labels 即可给特定 target 加专属标签;服务发现场景用 relabel_configs 从元数据标签生成。本文给出两种方式的配置示例。

查看 Prometheus 全部可用指标的四种方式:UI 的指标名下拉、/api/v1/label/__name__/values API、/metrics 自暴露端点、以及按 job 在 Targets/Service Disco…

统计标签唯一值数量的标准写法是嵌套 count:count(count(metric) by (label))——内层按标签分组,外层统计组数。本文给出实例、变体与常见错误写法。

用 relabel_configs 把 instance 标签的值改写为主机名:从 __address__ 提取 IP 段,或通过反向 DNS/元数据标签取主机名写入 instance。

Grafana 设置主页仪表盘的三层方式:个人首选项(星标后设为 Home)、组织级默认主页、以及 grafana.ini 的 default_home_dashboard_path 全局配置。本文给出各层操作步骤。

/metrics 端点暴露意味着任何人都能读取内部指标。保护方法:basic_auth/TLS 加密、网络层限制(防火墙/安全组)、反向代理统一鉴权、Prometheus 自身开启 web.config 认证。本文给出完整加固清单。

标签是 Prometheus 数据模型的核心:指标名 + 一组键值对标签唯一确定一条时间序列。本文讲清标签的作用、与指标名的关系、基数概念与使用规范。

Prometheus 四种指标类型:Counter(只增计数)、Gauge(可增可减瞬时值)、Histogram(分布直方图)、Summary(分位数摘要)。本文讲清每种类型的语义、适用场景与查询方式。

Grafana 面板的 Instant 开关把 PromQL 查询从"区间查询"切换为"即时查询"——只取当前时刻的一个值而非一段时间序列。适合数字面板/表格;画趋势曲线必须关闭。本文讲清原理与误用后果。