Categraf
Categraf 是一款 All-in-One 的数据采集器,支持指标、日志采集;支持物理机、虚拟机、交换机、容器、K8s、多种中间件/数据库的数据采集,支持混合云架构、云原生架构、多云架构。同时,Categraf 期望不止提供采集能力,还附带提供仪表盘和告警规则,力求开箱即用。
Categraf 相关文章
围绕 Categraf 的实践、选型、案例和产品内容,按同一阅读路径持续整理。
Categraf Redis 监控实战:配置、指标、大盘和告警
本文介绍如何使用 Categraf 采集 Redis 指标,包括实例配置、INFO 指标、慢查询、自定义命令、Grafana Dashboard、告警规则和常见问题排查。
Categraf MySQL 监控实战:配置、指标、大盘和告警
本文介绍如何使用 Categraf 采集 MySQL 指标,包括账号权限、实例配置、核心指标、Grafana Dashboard、告警规则和常见问题排查。
Categraf Grafana Dashboard 使用指南
本文介绍如何使用 Categraf 仓库中的 Grafana Dashboard,包括 Dashboard 文件选择、数据源配置、变量选择、导入验证和常见无数据问题排查。
Categraf 是什么:一篇文章讲清楚它适合什么场景
Categraf 是一款开源的 All-in-One 监控数据采集器,支持主机、中间件、数据库、Kubernetes、网络设备等多种监控对象,兼容 Prometheus 生态,并提供夜莺和 Grafana Dashboard。
Categraf Linux 主机监控实战:配置、指标和大盘
本文介绍如何使用 Categraf 采集 Linux 主机基础监控指标,包括 CPU、内存、磁盘、磁盘 IO、网络、系统负载和进程数,并导入夜莺或 Grafana Dashboard 完成主机监控闭环。
10 分钟跑起 Categraf + 夜莺 + VictoriaMetrics
本文介绍如何使用 Docker Compose 快速启动 Categraf、夜莺和 VictoriaMetrics,完成从主机指标采集、remote write 写入、PromQL 查询到 Dashboard 展示的最小监控闭环。
All-in-one 的监控数据采集器 Categraf 正式开源
介绍 Categraf 的定位、开源地址、采集器设计、与 Telegraf、Exporter、Grafana Agent、Datadog Agent 的差异,以及主配置、插件配置、采集频率、实例标签、大盘和告警规则的使用方式。
UDP端口探活的那些细节
UDP 是无连接协议,不能像 TCP 一样通过建立连接判断端口存活。本文结合 Categraf net_response 插件和 ncat 源码,说明 UDP 端口探活的判断逻辑与 Go 实现。
重构 Categraf SNMP 调度器:从随机抖动到确定性自适应
剖析 Categraf snmp_zabbix 插件的调度重构:从 Go Ticker 与随机 Jitter,演进到最小堆、墙上时钟对齐、OID 排序、BatchSize 与 MaxRepetitions 解耦,以及 0.85 因子自适应流控。
Categraf 监控采集器常见问题汇总
本文汇总 Categraf 监控采集器的常见配置问题,覆盖 hostname、writers、heartbeat、ibex、多实例、采集频率、标签、配置文件合并和机器 IP 获取等排查场景。
Categraf 托管与自升级
本文介绍 Categraf 在 Linux 下如何通过 systemd 或 SysVinit 托管服务,并使用 install、remove、start、stop、status、update 等命令完成启停、状态查看和自升级。
网络监控:无线监控这个面板好养眼
以 H3C 无线设备监控为案例,介绍 Categraf + vmagent + VictoriaMetrics + Grafana 架构如何替换 SNMP Exporter + Prometheus,并说明二进制部署、remote write、SNMP 采集配置、VMUI 验证和 Grafana 仪表盘展示。
通过 Categraf SNMP 插件采集监控数据
介绍如何通过 Categraf SNMP 插件采集监控数据,包括 SNMP agent 地址、版本、community、Scalar 数据、Table 数据、is_tag、inherit_tags 和 agent_host_tag 等关键配置。
Categraf SNMP 插件优化:解析带单位的监控指标
Categraf SNMP 插件通过启发式算法自动提取带单位字符串中的数值,解决浪潮等服务器返回 60 degree Celsius 格式导致指标采集失败的问题,无需正则即可智能解析温度、电流等复杂格式。
如何监控多个进程的存活和CPU、内存占用
使用夜莺监控、Categraf 和 VictoriaMetrics 监控多个进程的存活、CPU、内存、句柄、IO 等指标,并配置 procstat 插件和进程存活告警。
Nginx vts采集
本文介绍 Nginx vts 指标采集流程:添加 nginx-module-vts,配置 /vts_status 状态页,并通过 Categraf input.prometheus 插件采集 Prometheus 格式的 vhost、upstream 和状态码指标。
Nginx upstream采集
本文介绍 Nginx upstream 健康状态采集流程:添加 nginx_upstream_check_module,配置 /upstream_status 状态页,并通过 Categraf input.nginx_upstream_check 插件采集 upstream rise、fall、up/down 等指标。
Nginx stub status采集
本文介绍 Nginx stub status 指标采集的完整流程:在 CentOS 7.2 环境编译 http_stub_status_module,配置 /stub_status 状态页,并通过 Categraf input.nginx 插件采集连接数、读写状态和请求指标。
巧用Categraf探针mtail插件实现系统日志监控告警
介绍使用 Categraf 的 mtail 插件把系统日志异常转换为指标,再接入夜莺告警的轻量级方案,并给出 /var/log/messages 中 10 类严重系统错误的 mtail 规则示例。
从一个 Issue 谈 PID 1 与 Reaping 机制
基于 Categraf GitHub Issue #1261,解释容器中 PID 1 为什么会导致僵尸进程泄漏,以及如何通过 Go reapDaemon、SIGCHLD、wait4 和 PR_SET_CHILD_SUBREAPER 清理子进程。