Prometheus+Alertmanager+Grafana监控系统企业级实战
课程详情
课程标题
Prometheus+Alertmanager+Grafana监控系统企业级实战
课程核心介绍
本课程旨在帮助学员掌握使用Prometheus、Alertmanager和Grafana构建企业级监控系统的技能。
适合人群
- Linux工程师
- 运维工程师
- 开发工程师
- 系统架构师
- 运维监控工程师
学习收获
- 深入了解Prometheus、Alertmanager和Grafana的原理和应用
- 掌握企业级监控系统的搭建与维护
- 提升系统监控和故障排查能力
课程亮点
- 实战导向:通过实际案例,学习如何构建企业级监控系统
- 系统全面:涵盖Prometheus、Alertmanager和Grafana的核心知识
- 易于理解:深入浅出,适合不同层次的学员
课程目录
01 前言 01 个人简介及课程大纲 02 特别提醒 03 为什么要使用prometheus监控及度量值、度量指标的说明 04 常见传统开源监控工具对比 05 常见容器云监控系统对比 02 简介 01 prometheus优缺点 02 prometheus组件及架构 03 prometheus数据模型 04 核心指标、摘要及聚合 03 prometheus部署 01 环境及二进制部署 02 prometheus容器方式部署 04 prometheus配置 01 监控prometheus本身 02 配置命令详解 03 全局配置详解 04 配置采集目标 05 标签重写原理 06 标签使用案例剖析 05 node_export部署及使用 01 node_export部署 02 node_export使用案例 03 监控docker的容器(理论部分) 04 抓取的生命周期 06 pushgateway部署及使用 01 pushgateway介绍 02 pushgateway部署 03 pushgateway使用 07 promql使用 01 选择器及标签匹配器 02 偏移量修改器及子查询 03 PromeQL的操作符 04 PromQL函数 08 基础监控、持久化及可视化 01 计算CPU的空闲率 02 计算cpu的负载(饱和度) 03 计算内存使用率 04 磁盘使用率 05 服务状态 06 查询的持久化 07 grafana可视化 08 grafana的基本使用 09 服务发现 01 基于文件的服务发现 02 基于K8S API的服务发现 03 基于consul的服务发现 04 基于eureka的服务发现 05 针对服务注册中心是nacos的服务发现 06 基于DNS的服务发现 10 常见插件部署及使用 01 mtail的部署与使用 02 mtail使用补充 03 blackbox_exporter部署与使用 11 更高维度的监控 01 监控mysql 02 监控redis 03 监控elasticsearch 04 监控kafka 05 监控docker 06 监控rabbitmq 07 监控jvm 08 监控网站状态 12 alertmanager部署及使用 01 alertmanager工作方式 02 alertmanager部署 03 alertmanager的基本配置 04 监控alertmanager 05 添加警报规则 06 alertmanager路由的定义 07 定义接收器和模版 08 警报的静音 13 告警通知 01 邮件告警 02 (企业)微信通知 03 钉钉通知 14 k8s方式部署及使用 01 k8s部署alertmanager 02 部署node_export 03 k8s部署prometheus 04 部署grafana 05 k8s部署kube-state-metrics 06 kube-state-metrics的使用 15 浅析可靠性、容错性及扩展 01 可靠性和容错性 16 其他 01 promtool工具探索 02 log和endpoints






