跳到主要内容

部署

按 HAP 的部署模式选一种,然后从头到尾照着那一篇做完即可——每篇都是完整的一条流水线,不需要在几篇之间来回跳。

你的情况选这篇
HAP 单机模式(Docker Compose)单机部署
HAP 集群模式(Kubernetes)集群部署
采集 K8s 指标要求平台装在被监控集群内

单机部署只能监控主机与中间件,不具备 K8s 采集能力(1.5.3 起已移除集群外采集方式)。想监控哪个 K8s 集群,就把运维平台装进那个集群。

资源要求:4C / 8G 以上;磁盘按部署方式算——单机建议 100G 以上,集群 PVC 方案默认申请 130Gi(Prometheus 100 + ops-mongo 20 + Grafana 10,可在 30-stateful.yaml 里调小)。1.4.0 起所有组件合并为单一镜像 ops-allinone,各服务靠 ROLE 区分角色,只需拉取一个镜像;告警配置存在内置 ops-mongo,无需额外准备数据库。

被监控中间件的账号权限:平台是旁路观测系统,各被监控目标需要一个只读账号,具体权限见数据源

装完之后

部署只是让平台自己跑起来。接下来把要监控的对象接进来:

  1. 数据源——登记主机与中间件
  2. Node Exporter——监控集群外的服务器
  3. Kubernetes 集群——采集节点 / 容器 / 集群对象状态
  4. 服务日志——让 HAP 微服务把日志推过来
  5. 链路追踪——让业务上报调用链

「参考」下的对象存储环境变量是查阅用的,按需查即可。