Prometheus+Alertmanager+Grafana监控系统企业级实战

课程详情

课程标题

Prometheus+Alertmanager+Grafana监控系统企业级实战

课程核心介绍

本课程旨在帮助学员掌握使用Prometheus、Alertmanager和Grafana构建企业级监控系统的技能。

适合人群

  • Linux工程师
  • 运维工程师
  • 开发工程师
  • 系统架构师
  • 运维监控工程师

学习收获

  • 深入了解Prometheus、Alertmanager和Grafana的原理和应用
  • 掌握企业级监控系统的搭建与维护
  • 提升系统监控和故障排查能力

课程亮点

  • 实战导向:通过实际案例,学习如何构建企业级监控系统
  • 系统全面:涵盖Prometheus、Alertmanager和Grafana的核心知识
  • 易于理解:深入浅出,适合不同层次的学员

课程目录

01 前言
  01 个人简介及课程大纲
  02 特别提醒
  03 为什么要使用prometheus监控及度量值、度量指标的说明
  04 常见传统开源监控工具对比
  05 常见容器云监控系统对比
02 简介
  01 prometheus优缺点
  02 prometheus组件及架构
  03 prometheus数据模型
  04 核心指标、摘要及聚合
03 prometheus部署
  01 环境及二进制部署
  02 prometheus容器方式部署
04 prometheus配置
  01 监控prometheus本身
  02 配置命令详解
  03 全局配置详解
  04 配置采集目标
  05 标签重写原理
  06 标签使用案例剖析
05 node_export部署及使用
  01 node_export部署
  02 node_export使用案例
  03 监控docker的容器(理论部分)
  04 抓取的生命周期
06 pushgateway部署及使用
  01 pushgateway介绍
  02 pushgateway部署
  03 pushgateway使用
07 promql使用
  01 选择器及标签匹配器
  02 偏移量修改器及子查询
  03 PromeQL的操作符
  04 PromQL函数
08 基础监控、持久化及可视化
  01 计算CPU的空闲率
  02 计算cpu的负载(饱和度)
  03 计算内存使用率
  04 磁盘使用率
  05 服务状态
  06 查询的持久化
  07 grafana可视化
  08 grafana的基本使用
09 服务发现
  01 基于文件的服务发现
  02 基于K8S API的服务发现
  03 基于consul的服务发现
  04 基于eureka的服务发现
  05 针对服务注册中心是nacos的服务发现
  06 基于DNS的服务发现
10 常见插件部署及使用
  01 mtail的部署与使用
  02 mtail使用补充
  03 blackbox_exporter部署与使用
11 更高维度的监控
  01 监控mysql
  02 监控redis
  03 监控elasticsearch
  04 监控kafka
  05 监控docker
  06 监控rabbitmq
  07 监控jvm
  08 监控网站状态
12 alertmanager部署及使用
  01 alertmanager工作方式
  02 alertmanager部署
  03 alertmanager的基本配置
  04 监控alertmanager
  05 添加警报规则
  06 alertmanager路由的定义
  07 定义接收器和模版
  08 警报的静音
13 告警通知
  01 邮件告警
  02 (企业)微信通知
  03 钉钉通知
14 k8s方式部署及使用
  01 k8s部署alertmanager
  02 部署node_export
  03 k8s部署prometheus
  04 部署grafana
  05 k8s部署kube-state-metrics
  06 kube-state-metrics的使用
15 浅析可靠性、容错性及扩展
  01 可靠性和容错性
16 其他
  01 promtool工具探索
  02 log和endpoints