入行5年,谈谈我在阿里做测试开发的经验
阿里妹导读
《个人成长》
成长的路径
成长的标准
成长的矛盾
《研发效能》
有价值
可持续
高能力
《稳定性》
运气与文化
薛定谔的稳定性
理论SLA:相信很多团队的SLA目标是拍着胸脯承诺的,也是拍着脑袋决定的😅;SLA 4个9 应该是一个行业标准和稳定性级别,作为目标对于很多团队来说过于理想(不排除一些成熟度很高的团队)。因为SLA是有一个理论值的,这个理论值是可以一层一层算出来的。把这个SLA认为是故障不出现的概率(一年内可使用的时间/总时间,也就是一年内故障不出现的概率),举几个例子:
资损敞口:资损和可用率一样,不到财年底并不清楚今年资损了多少金额,资金平衡的程度到了什么阶段。我们团队的资损OKR已经连续两年是0资损了,并且都做到了,但滞后的度量总让我觉得是一种“薛定谔行为”。其实一个业务的资损敞口我认为也是可以计算的:
全域依赖系数:依赖治理是稳定性的重要课题,但治理的速度甚至没有腐化的速度快。以至于依赖治理这个项目一直处于“按下葫芦,起了瓢”的状态,也很难度量专项在完成进度和水平。于是我们从鹰眼实时采集数据,做了如下的全域依赖关系图。每个节点是一个应用,每一条连线是有方向的,箭头方向表示依赖方向,线也是有权重的,权重就是qps。于是就得到了下面这样,有向加权图。图中线越多,说明依赖关系越复杂;线的权重越大,说明依赖关系就越强。于是我们可以用一下的表达式来计算全域依赖系数:
《团队管理》