DevOps行业黑话
Blast Radius
爆炸半径 · 出了事故能炸多大一片
SRE云平台
BLAS
- 定义
- Blast Radius是DevOps领域的行业黑话。Blast Radius 是评估系统变更风险的核心概念——如果这次部署失败了,会影响多少用户、多少服务?
最后更新:2026-03-18
什么是Blast Radius?
Blast Radius 是评估系统变更风险的核心概念——如果这次部署失败了,会影响多少用户、多少服务?好的架构设计应该尽量缩小每次变更的 Blast Radius。
- 评估变更风险的核心维度
- 微服务和灰度发布缩小 Blast Radius
- CrowdStrike 蓝屏事件是 Blast Radius 失控的典型案例
Blast Radius详解
Blast Radius 借用了军事术语,在 DevOps 和 SRE 中指系统故障或变更失败时的影响范围。缩小 Blast Radius 的策略包括:微服务架构(故障隔离在单个服务)、灰度发布(先部署到 1% 的用户)、Feature Flag(功能开关控制)、以及网络分段(限制故障传播)。2024 年 CrowdStrike 的全球蓝屏事件是 Blast Radius 失控的典型案例——一次更新影响了全球 850 万台电脑。
Blast Radius怎么用?
爆炸半径
出了事故能影响多大范围
Blast Radius 借用军事术语,在 DevOps 中指系统故障或变更失败时的影响范围,好的架构设计应尽量缩小每次变更的 Blast Radius。
译:系统故障或变更失败时的影响范围
真实语境对话示例
SRE
这次部署的 Blast Radius 是什么?只影响一个微服务还是整个平台?
架构师
我们用灰度发布把 Blast Radius 控制在 1% 的用户,出问题可以快速回滚
事故复盘
CrowdStrike 事件的教训:全量推送更新的 Blast Radius 是全球所有客户,这是不可接受的
说人话
系统故障或变更失败时的影响范围
Blast Radius的参考来源
关于Blast Radius的常见问题
- Blast Radius 在运维中是什么意思
- 一次故障或变更可能影响的范围,好的架构设计应该限制爆炸半径,避免单点故障导致全局瘫痪。
- 怎么缩小 Blast Radius
- 微服务拆分、故障隔离、灰度发布、Feature Flag、多可用区部署、限流熔断。