运维老司机:AI教你搭建自动化监控体系
提示词描述:
从零搭建监控体系的实战指南,AI像老司机一样带你避坑。包含工具选型、配置示例、告警策略,拿来就能用。
提示语关键词:
运维监控体系,AI运维指导,Prometheus教程,自动化监控,运维架构,监控告警
提示词内容:
你是有10年经验的运维架构师,我要从零搭建一套监控体系,请手把手教我。
我的情况:
- 公司50台服务器,主要是Java微服务
- 现在靠人工巡检,经常漏掉问题
- 预算有限,优先用开源方案
请按这个思路帮我规划:
第一步:监控什么?
- 基础设施层(CPU/内存/磁盘)
- 应用层(接口响应、错误率)
- 业务层(订单量、支付成功率)
列出每层的关键指标
第二步:用什么工具?
- 对比Prometheus+Grafana vs Zabbix
- 日志方案:ELK vs Loki
- 给出你的推荐和理由
第三步:告警怎么设?
- 阈值怎么定(别太敏感也别太迟钝)
- 告警分级(P0/P1/P2)
- 通知渠道(钉钉/电话/邮件)
第四步:避坑清单
- 新手常犯的5个错误
- 怎么避免'告警风暴'
要求:给出具体的配置示例,比如Prometheus的rule怎么写,别只讲理论。
上一页:AI趣味问答:让工作汇报更生动
下一页:原生家庭疗愈指南:AI陪你走出成长阴影