部署
按 HAP 的部署模式选一种,然后从头到尾照着那一篇做完即可——每篇都是完整的一条流水线,不需要在几篇之间来回跳。
| 你的情况 | 选这篇 |
|---|---|
| HAP 单机模式(Docker Compose) | 单机部署 |
| HAP 集群模式(Kubernetes) | 集群部署 |
采集 K8s 指标要求平台装在被监控集群内
单机部署只能监控主机与中间件,不具备 K8s 采集能力(1.5.3 起已移除集群外采集方式)。想监控哪个 K8s 集群,就把运维平台装进那个集群。
资源要求:4C / 8G 以上;磁盘按部署方式算——单机建议 100G 以上,集群 PVC 方案默认申请 130Gi(Prometheus 100 + ops-mongo 20 + Grafana 10,可在 30-stateful.yaml 里调小)。1.4.0 起所有组件合并为单一镜像 ops-allinone,各服务靠 ROLE 区分角色,只需拉取一个镜像;告警配置存在内置 ops-mongo,无需额外准备数据库。
被监控中间件的账号权限:平台是旁路观测系统,各被监控目标需要一个只读账号,具体权限见数据源。
装完之后
部署只是让平台自己跑起来。接下来把要监控的对象接进来:
- 数据源——登记主机与中间件
- Node Exporter——监控集群外的服务器
- Kubernetes 集群——采集节点 / 容器 / 集群对象状态
- 服务日志——让 HAP 微服务把日志推过来
- 链路追踪——让业务上报调用链