开源版
夜莺V6
项目介绍
架构介绍
快速开始
黄埔营
安装部署
升级
采集器
使用手册
API
数据库表结构
alert_aggr_view
alert_cur_event
alert_his_event
alert_mute
alert_rule
alert_subscribe
alerting_engines
board
board_payload
builtin_cate
busi_group
busi_group_member
chart_share
configs
datasource
metric_view
notify_tpl
recording_rule
role
role_operation
sso_config
target
task_record
task_tpl
task_tpl_host
user_group
user_group_member
users
FAQ
夜莺V5
企业版
智能告警
夜莺开源生态
Telegraf
Prometheus
版权声明
第1章:天降奇兵
第2章:探索PromQL
开篇
理解时间序列
Metrics类型
初识PromQL
PromQL操作符
PromQL聚合操作
PromQL内置函数
在HTTP API中使用PromQL
最佳实践:4个黄金指标和USE方法
小结
第3章:Prometheus告警处理
开篇
Prometheus告警简介
自定义Prometheus告警规则
部署Alertmanager
Alertmanager配置概述
基于标签的告警处理路由
使用Receiver接收告警信息
告警模板详解
屏蔽告警通知
使用Recoding Rules优化性能
小结
第4章:Exporter详解
第5章:数据与可视化
第6章:集群与高可用
第7章:Prometheus服务发现
第8章:监控Kubernetes
开篇
初识Kubernetes
在Kubernetes下部署Prometheus
Kubernetes下的服务发现
使用Prometheus监控Kubernetes集群
基于Prometheus的弹性伸缩
小结
第9章:Prometheus Operator
参考资料
事件墙系统简介
事件墙系统通过收集、展示、管理业务的变更、报警、运营等生产事件,提供辅助故障定位的关键信息。
术语
概念 | 说明 |
---|---|
事件墙 | 该子系统的统称,主要有事件、关联规则等概念。 |
事件 | 事件墙系统首页展示的基本单元,如一次发布、一组因规则关联在一起的报警集合、一次业务运营的消息推送等。 一个事件可能包含多条记录。 |
记录 | 是组成事件的基本单元,一个事件中可能包含由关联规则关联在一起的多条记录。如一个告警事件里面可能包含了多条告警记录。 |
关联规则 | 事件墙系统采集接收的记录都会附带一些标签/属性,可以基于这些标签/属性设置关联规则,将相关的记录组合成一个事件,既有利于观测事件状态又可以收敛事件的数量。 事件墙系统要求告警记录必须有关联规则才能聚合成事件,在事件墙上展示。 |
筛选标签 | 设置在事件墙上方,可点击筛选事件集合。 系统中可以通过设置,将常用的标签固定在筛选列表上。 |
产品架构