标签
#监控告警
20 篇文章
-
Zabbix Agent Active 主动模式配置
Zabbix Server 监控主机过多导致性能问题时,调整 Agent 为主动模式。配置 zabbix_agentd.conf 和修改监控模板以启用主动检查。
-
网卡流量监控
实时监控网卡流量的脚本,显示发送/接收速率,支持不同单位自动转换。
-
Druid 集群监控方案
Druid 集群监控使用 Prometheus + druid_exporter 方案。druid_exporter 是 Python 组件,采集 Druid 指标并暴露 HTTP 接口给 Prometheus。
-
Kafka 监控搭建
Kafka 集群监控使用 Prometheus + Grafana + JMX 方案。通过 jmx_prometheus_javaagent 采集 Kafka JMX 指标,配置 Prometheus 和 Grafana 展示监控面板。
-
我的 Grafana 配置
Grafana 多租户架构配置笔记。覆盖 Organization、User、Team 角色管理,InfluxDB 数据源配置(Proxy 模式),告警方式配置(Webhook/钩子)。
-
Grafana + MySQL 数据源配置
Grafana 使用 MySQL 数据库作为数据源的配置方法。包括 default.ini 数据库配置、账户权限设置、dashboard 创建与 SQL 查询配置步骤。
-
Prometheus入门
Prometheus 与时序数据库(TSDB)的基础概念。TSDB 特性、写入模式、时间排序、数据采集和保留策略等核心原理。
-
监控与告警
大规模系统监控与告警的核心原则。覆盖黄金指标(延迟、流量、错误、饱和度)、告警设计(避免狼来了效应、可操作性)以及白盒/黑盒监控方案。
-
Docker容器的监控技术
Docker 容器监控的核心理论与工具选型。覆盖黑盒/白盒监控、自主托管方案(CAdvisor+StatsD+InfluxDB+Grafana、Prometheus、Graphite)与 SaaS 方案(Datadog、Sysdig)对比。
-
快速部署 Prometheus 监控系统
Prometheus 快速部署指南。以 Docker 容器方式部署 Prometheus Server、Node Exporter、cAdvisor、Grafana,涵盖配置、启动命令与验证步骤。
-
Python主机监控数据收集
Python 脚本收集服务器硬件和网络信息(IP、厂商、型号、SN、CPU、内存等),用 dmidecode、ifconfig、/proc 等。
-
线程监控
使用 ps 和 top 命令查看进程线程信息及其绑定的 CPU。
-
请不要用SECONDS_BEHIND_MASTER来衡量MYSQL主备的延迟时间
“Seconds_Behind_Master 无法准确衡量 MySQL 主备复制延迟,分析其限制原因,提出被动监控和主动预防两种方案。”
-
iptraf使用心得——如何查看网络流量
iptraf是网络流量监控工具,可通过IP traffic monitor、General interface statistics等功能查看实时网络流量分布。需要配置Reverse DNS lookups和TCP/UDP service names等选项以获得直观结果。
-
Linux的IO性能监控工具iostat详解
iostat用来监控磁盘IO性能,可显示设备的TPS、读写速率、响应时间等指标。常用参数:-d显示设备使用,-x显示扩展信息,-c显示CPU状态。
-
网络流量监控
基于 ifconfig 的网络流量监控脚本,实时显示网卡的发送/接收速率和平均流量。
-
linux 中系统性能分析命令 top 用法详解
top 命令是 Linux 常用性能分析工具,实时显示系统进程的资源占用,类似 Windows 任务管理器;支持按 CPU/内存排序,可通过交互命令修改显示内容。
-
Linux vmstat 命令实战详解
vmstat 监控工具的使用方法和详解,包括参数含义、实战示例和性能分析应用
-
Nagios 基本配置详解
Nagios 监控系统的配置入门教程,详细讲解 localhost.cfg 的功能定义、工作原理和配置方法,通过实际配置加深理解。
-
heartbeat 监控 MySQL 的脚本
监控 MySQL 进程状态的脚本,若进程停止则自动重启 Heartbeat 高可用服务。