AustinDatabases

DB 监控 --数据库监控高科技,出道题你能选对了吗?

❝

开头还是介绍一下群,如果感兴趣PolarDB ,MongoDB ,MySQL ,PostgreSQL ,Redis, OceanBase, Sql Server等有问题,有需求都可以加群群内有各大数据库行业大咖,可以解决你的问题。加群请联系 liuaustin3 ,(共3400人左右 1 + 2 + 3 + 4 +5 + 6 + 7 + 8 +9)(1 2 3 4 5 6 7 8群已经爆满  9群 300+,开10群PolarDB专业学习群110+ 针对 SQLite 我们将建立一个新的群sqlite的群,如果需要请加群的时候单独告知)

上期咱们讲到了怎么调整告警的拼读以及智能告警的一个初步的模型,今天咱们说说另一个话题,怎么根除一些潜在的问题,尤其现在AI提效,咱们怎么避免被AI干掉,或者尽量不被AI干掉。

DB 监控 --DBA挨罚后,咱们说说怎么能不挨罚的解决方案(4)?

DB 监控 --乱搞监控最后挨罚了吧?(3)

DB 监控 不是我不聪明系列--只从技术角度考虑监控问题是要挨骂的(2)

DB 监控-告警老明白了,但就是搞不好 ,老挨骂-- 不是我不聪明系列(1)

MYSQL  innodb buffer pool  原理与监控

这也就是预期监控,预期监控的含义是,把潜在要发生问题的发现出来,并且将问题灭杀在萌芽中。

空道理都懂,但是实现就难了,那么今天咱们开始说说怎么进行数据库监控,提前发现问题的思路和具体操作的方法。

这里我们的寄出两个公式

环比增长率 和 同比增长率,什么是环比,什么是同比

环比增长率 = (本期值 − 上期值) / 上期值 × 100% 同比增长率 = (本期值 − 去年同期值) / 去年同期值 × 100%

环比是发现短时间问题的一个好手,比如我们数据库常见的几个指标,QPS ,TPS,日志空间,CPU ,内存,连接数。当然还有更多,具体我们后面几期可以继续说。

我们举一个例子,一个业务的数据库库,CPU 很长一段时间在 20-30%,我们通过环比,比对每天的CPU值的变化,基本如果每天的值都不变,或者变动很少的情况下,

突然有一天CPU 从 (80 - 20 )/ 20 * 100% = 400%  那么我们就发现这个数据库上的CPU 突然暴涨了400%,写到这里,有人说这根本不用环比。

那么我们举另一个例子,(25 - 20)/ 20 * 100% = 25%,到这里你发现问题了,如果CPU 就增长从 20 -25 没有人会注意,但是如果我用百分比 CPU环比增长了25%,你是不是会注意,如果这个环比我们比对了 7天也就是一周,发现每天这个环比都在上涨 从 25% 到了 40%,此时你是不是呀问问,怎么回事。

这也就是我们今天要说把问题消灭在萌芽,因为CPU我们设置80%才告警,如果没有环比的对比,可能某天突然数据库就不是到80%了,是100% 120%,数据库直接就挂了。

所以环比是帮助我们发现每天的各种细微的变化,并把他放大,让我们知道的更多。

在比如慢查询,用这个就特别的合适,我们出一道题

在一个业务系统中,经常出现一些慢查询,这些满查询平时DBA已经优化了,同时也让开发进行改写,但最近我们发现,数据库的满查询的环比在增长,且没有任何的新项目,并且CPU 内存都环比不动的情况下,请问数据库系统可能出现什么问题?

我们来一个多选题

A  数据量在变大,索引的效率在变低,我们需要针对索引的效率进行查看,是不是索引又失效的

B  SQL 执行计划出现问题,优化器在数据量增长或者统计信息收集不畅的情况下,语句执行效率变低

C  随着数据量的增大数据库启用了并行,导致CPU被征用,而导致慢查询变多

D  数据库中的查询中分页查询,从最早的 1-10,变成了 10-20成为客户经常查询的范围

正确答案咱们讨论

图片