深色模式
运维成熟度模型
摘要:成熟度模型的作用不是打分排名,而是找出最短板。本文从可观测、自动化、流程、韧性、组织五个维度自评,给出评分表与"先补哪块"的决策方法。
适用环境
bash
mkdir -p maturity && cd maturity
# 自评依赖事实数据,不是主观印象
ls -1 ../runbooks/*.md 2>/dev/null | wc -l
kubectl get cronjob -A 2>/dev/null | wc -l1
2
3
4
2
3
4
操作步骤
第 1 步:五个维度与分级定义
bash
cat > dimensions.md <<'EOF'
| 维度 | L1 初始 | L3 规范 | L5 优化 |
| --- | --- | --- | --- |
| 可观测 | 只有基础监控 | 有 SLO 与告警分级 | 全链路追踪 + 预测 |
| 自动化 | 手工操作 | 脚本化 | 自愈与 GitOps |
| 流程 | 口头约定 | 有 SOP 与变更流程 | 流程内建于工具 |
| 韧性 | 出问题才修 | 定期演练 | 常态化混沌 |
| 组织 | 依赖个人 | 有值班与复盘 | 无责文化 + 知识沉淀 |
EOF1
2
3
4
5
6
7
8
9
2
3
4
5
6
7
8
9
第 2 步:逐维打分
bash
cat > score.sh <<'EOF'
#!/usr/bin/env bash
# 用法: ./score.sh <可观测> <自动化> <流程> <韧性> <组织> (1-5)
read -r o a p r org <<< "$*"
total=$((o+a+p+r+org))
echo "可观测=$o 自动化=$a 流程=$p 韧性=$r 组织=$org"
echo "总分: $total/25"
low=$(for v in "$o" "$a" "$p" "$r" "$org"; do echo "$v"; done | sort -n | head -1)
echo "最低维度分值: $low(优先改进)"
EOF
chmod +x score.sh && ./score.sh 3 2 3 2 31
2
3
4
5
6
7
8
9
10
11
2
3
4
5
6
7
8
9
10
11
第 3 步:按短板排序改进
bash
cat > roadmap.md <<'EOF'
改进顺序原则:
1. 先补可观测——看不到就无法评估任何改进
2. 再补流程——把高频高风险操作固化
3. 然后自动化——把流程沉淀为工具
4. 最后韧性与组织——长期工程
EOF1
2
3
4
5
6
7
2
3
4
5
6
7
第 4 步:季度复评,记录趋势
bash
{
echo "## 复评 $(date +%F)"
./score.sh 3 3 3 2 3
} >> history.md
tail -6 history.md1
2
3
4
5
2
3
4
5
第 5 步:把改进项落到具体动作
bash
cat >> roadmap.md <<'EOF'
## 本季度改进项(自动化维度 L2 -> L3)
| 动作 | 负责人 | 截止 | 验收 |
| --- | --- | --- | --- |
| 发布流水线化 | @a | 2026-12-31 | 生产发布全部走流水线 |
| 巡检脚本化 | @b | 2026-12-31 | 每日自动输出巡检报告 |
EOF1
2
3
4
5
6
7
8
2
3
4
5
6
7
8
验证
bash
# 1. 评分脚本输出总分与最低维度
./score.sh 4 3 4 3 4
# 2. 复评记录累积可对比
grep -c '## 复评' history.md
# 3. 改进项有负责人与验收标准
grep -c '| @' roadmap.md1
2
3
4
5
6
7
8
2
3
4
5
6
7
8
常见坑
把成熟度当成绩效指标
为拿高分而堆文档、堆工具,实际能力不变。成熟度只用于内部定位改进方向。
五个维度平均用力
资源有限时平均投入等于都没改善。集中补最短的一块,逐块推进。
跳过可观测直接上自动化
没有可靠指标就做自动决策(如自动扩容、自动重启),会把错误放大。可观测是自动化的前置条件。