前言

【老方案:多Prometheus,分散存储】
集群A → Prometheus-A(抓取+本地TSDB存储)
集群B → Prometheus-B(抓取+本地TSDB存储)
Grafana需要分别连A、B两个Prometheus,无法统一全局视图

【方案1:Thanos 分布式扩展方案(必须依赖Prometheus)】
集群A → Prometheus-A + Thanos Sidecar
集群B → Prometheus-B + Thanos Sidecar
Sidecar热数据本地留存,冷数据上传对象存储(S3/MinIO)
Thanos Querier统一聚合所有Prometheus本地数据 + 对象存储历史数据
Grafana ← 查询 Thanos Querier(一套入口查看全部指标)

【方案2:VM聚合方案(A和B两条可选路线,二选一)】
方案2-A路线(无Prometheus)
集群业务 → vmagent(直接抓取指标) → VictoriaMetrics自研引擎统一存储

方案2-B路线(存量改造,保留原有Prometheus做汇聚)
集群A → Prometheus-A remote_write → VictoriaMetrics
集群B → Prometheus-B remote_write → VictoriaMetrics
Grafana ← 查询 VictoriaMetrics(一套入口查看全部指标)

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

参考

 

posted on 2026-07-29 14:52  运维体系建设之路  阅读(4)  评论(0)    收藏  举报