构建统一采集指标、日志、追踪与性能剖析的可编程观测流水线
用 Docker 部署 GPUStack 集群管理器,编排 vLLM 等推理引擎提供 OpenAI 兼容模型服务。
GPUStack 负责调度与运维,自动配置推理引擎执行推理,Grafana/Prometheus 提供监控仪表板,Docker 承载部署。
为 MySQL 数据库提供生产可用的 Prometheus 告警规则,复制即用。
Prometheus 通过 YAML 告警规则监控 MySQL,仓库为该组合提供成套规则。
为 Kubernetes 集群提供生产可用的 Prometheus 告警规则,直接复制部署。
Prometheus 通过告警规则 YAML 监控 Kubernetes 集群,规则即复制即用的最佳实践。
用 VictoriaMetrics 统一接收多协议监控数据实现异构指标汇聚
以 VictoriaMetrics 作为 Prometheus 长期存储并在 Grafana 中替代查询
Prometheus 采集数据,VictoriaMetrics 提供可扩展长期存储与全局查询视图,Grafana 直接查询展示