zabbix 报警媒介-邮箱报警
·
zabbix 报警媒介-邮箱报警
报警媒介
模板
模板自带的监控项,服务硬件资源的使用率
自定义监控
- linux命令的采集
- 创建监控项,获取结果
- 设定触发器(条件判断)判断得出结果后,设定动作(zabbix-web界面,显示xx问题)
- 得对于数据进行展示,zabbix-web界面图形化看数据
既然机器已经报警,图示也出来了
但是我没有看监控大屏,我怎么知道机器出来故障
报警啊
邮件,微信,钉钉搞起来
666
邮件报警配置
设置一个报警条件的场景
1.tcp状态监控(time_wait 超过xx数量)(自定义监控项,触发器的玩法)
2.报警动作,几个条件
发给谁?
标题是什么?
消息正文是什么?
【判断当前机器登录用户的数量,超过3个】就【发邮件通知运维】
【报警信息正文,登陆服务器的root用户太多了,有点危险,快来看看】
配置监控登录用户数量的之定义的key
判断当前机器登录的用户数量,超过3个
1.提前的想好这个需求,如何用命令采集,构造出结果
who|wc -l
2. 写zabbix-agent的配置文件
[root@zabbix zabbix_agentd.d]# cat userparameter_login.conf
UserParameter=login.user,who | wc -l
3. 重启agent
systemctl restart zabbix-agent.service
4.去zabbix-ui界面,创建监控项(所有机器都好使),让这个监控项,和模板绑定,模板再给主机去用
- 给现有的模板添加监控项 template os linux (目前监控的主机,都以及和它关联了,登录用户数量检测的key,就立即可以生效了)
- 新创建模板,添加监控项(和主机关联这个模板)
给web7,设置这个 自定义key的配置文件
创建配置文件,重启,看最新数据即可
[root@web-7 /etc/zabbix/zabbix_agentd.d]#cat userparameter_login_user.conf
UserParameter=login.user,who|wc -l
systemctl restart zabbix-agent.service

5.关联这个模板使用自定义的key值
6.通过最新数据,看看监控项拿到数据了吗?通过最新数据,查看web7是否拿到了登录用户数量


最后注意对应的机器上要有这个key的创建
设置触发器
只要机器登录的用户超过3个,就提示告警级别的信息
基于模板的配置,能给多个主机去用

查看触发器的执行结果

作业个定时器
[root@zabbix ~]# crontab -e
no crontab for root - using an empty one
crontab: installing new crontab
[root@zabbix ~]# crontab -l
* * * * * ntpdate -u ntp1.aliyun.com
你可以关闭问题,对这个问题的某些动作
如果要关闭问题,需要
0. 服务器故障被修复,自动关闭
1. 触发器允许手动关闭
2. 如果默认的模板关闭不了,那是默认的触发器不允许手动关闭。


报警媒介类型设置
你的监控,触发了报警,具体的动作
1. 手动确认,关闭了这个问题
2. zabbix自动执行的动作,如给你发个邮件
1. 对zabbix-server 添加一个可以发邮件的账户
2. 要给谁发?发什么格式的信息?
发件人的设置

重新开启该功能,生成授权码(等于邮件的密码)
记下来,待会填入zabbix
zaxrfnkhjaercjge

收件人配置

设置发信息动作

测试报警发邮件动作
超过触发器的条件呗

`ok了这里就收到消息了
自定义报警内容
zabbix默认的报警内容,不够友好,自定义一波,更清晰。

恢复标题:恢复{TRIGGER.STATUS}, 服务器:{HOSTNAME1}: {TRIGGER.NAME}已恢复!
=================恢复信息=============
告警主机:{HOSTNAME1} {HOST.IP}
告警时间:{EVENT.DATE} {EVENT.TIME}
告警等级:{TRIGGER.SEVERITY}
告警信息: {TRIGGER.NAME}
告警项目:{TRIGGER.KEY1}
问题详情:{ITEM.NAME}:{ITEM.VALUE}
当前状态:{TRIGGER.STATUS}:{ITEM.VALUE1}
事件ID:{EVENT.ID}
=======================================
更多推荐
所有评论(0)