一句话定义:爆炸半径(Blast Radius)原本指一次爆炸中受波及的范围,在 AI 语境里,它指一个模型、Agent 或自动化流程出错时,最坏情况下能连带影响到多少数据、系统、人和钱。
它为什么在 AI 时代突然重要
传统软件是确定性的:你写什么它做什么,出错通常表现为报错、崩溃、返回空值。Agent 不一样,它自己决定调哪个工具、按什么顺序调、失败后要不要重试。这意味着错误会沿着调用链扩散——一步判断错了,后面十步都在放大这个错误。
打个比方:你请人来装厨房水龙头。普通程序是"只碰水龙头,拧不动就停下来喊你"。Agent 是"你让它顺手把厨房收拾一下"——它可能关了总水阀、拆了水管、顺带把邻居家的墙也打了。爆炸半径 = 你给它的授权范围 × 它能触达的系统 × 这些动作有多难撤销。
这三个乘数里,最容易失控的是后两个。很多事故不是因为模型"很笨",而是因为它太听话、权限又太大。
和相邻概念的区别
- 幻觉(AI 词典:Hallucination">Hallucination):讲的是"输出错了"。爆炸半径讲的是"错误落地之后影响多大"。一个只连着聊天框的模型,幻觉再离谱,爆炸半径也接近于零。
- 越权攻击:那是有人主动作恶。爆炸半径是设计属性——它问的是"即使没人攻击,这玩意儿只是犯傻,最坏能坏成什么样"。
- 护栏(Guardrail):那是缩小爆炸半径的手段之一,不是同一个东西。
| 维度 | 爆炸半径小 | 爆炸半径大 |
|---|---|---|
| 权限 | 只读,或限定单表、单目录 | 生产库读写、管理员账号 |
| 环境 | 沙箱、数据副本 | 直接连生产环境 |
| 动作 | 只生成草稿,等人确认 | 直接发送、执行、支付 |
| 可逆性 | 软删除、可撤销 | 硬删除、对外发布 |
| 范围 | 单用户、单条记录 | 全量批量操作 |
| 兜底 | 超时熔断、额度限制 | 无限重试、无人值守 |
怎么提前把它画小
从业者上线一个 Agent 前,值得把下面几条当默认动作:
1. 最小权限:默认只读,写权限单独申请;给 Agent 一个专用账号,别用你自己的。
2. 先干跑(Dry Run):在副本或测试环境跑通,动作先"预演"一遍再真的执行。
3. 可逆优先:能做草稿箱就不直接发,能软删除就不硬删。不可逆的动作一定要人确认。
4. 限额与熔断:一次最多发几封邮件、最多改几行数据,超阈值就停。
5. 留痕与回滚:每个动作有日志,出事后能定位到哪一步、能退回去。
对普通职场人,这套思路同样好用:接受一个 AI 工具替你干活之前,先问一句"它能碰到我哪些东西、碰坏了能不能收回来",答案往往决定了你敢不敢按下那个授权按钮。
最后留一个自检问题,一句话就能用:如果它今天彻底跑偏了,最坏会怎样? 把答案写下来——那就是你的爆炸半径。写不出来,说明它还没想清楚。
