跳到主内容
快讯直播
AI智模界
AI 词典

爆炸半径:一个跑偏的 Agent 能毁掉多少东西

一句话定义:爆炸半径(Blast Radius)原本指一次爆炸中受波及的范围,在 AI 语境里,它指一个模型、Agent 或自动化流程出错时,最坏情况下能连带影响到多少数据、系统、人和钱。

它为什么在 AI 时代突然重要

传统软件是确定性的:你写什么它做什么,出错通常表现为报错、崩溃、返回空值。Agent 不一样,它自己决定调哪个工具、按什么顺序调、失败后要不要重试。这意味着错误会沿着调用链扩散——一步判断错了,后面十步都在放大这个错误。

打个比方:你请人来装厨房水龙头。普通程序是"只碰水龙头,拧不动就停下来喊你"。Agent 是"你让它顺手把厨房收拾一下"——它可能关了总水阀、拆了水管、顺带把邻居家的墙也打了。爆炸半径 = 你给它的授权范围 × 它能触达的系统 × 这些动作有多难撤销。

这三个乘数里,最容易失控的是后两个。很多事故不是因为模型"很笨",而是因为它太听话、权限又太大。

和相邻概念的区别

  • 幻觉(AI 词典:Hallucination">Hallucination):讲的是"输出错了"。爆炸半径讲的是"错误落地之后影响多大"。一个只连着聊天框的模型,幻觉再离谱,爆炸半径也接近于零。
  • 越权攻击:那是有人主动作恶。爆炸半径是设计属性——它问的是"即使没人攻击,这玩意儿只是犯傻,最坏能坏成什么样"。
  • 护栏(Guardrail):那是缩小爆炸半径的手段之一,不是同一个东西。
维度爆炸半径小爆炸半径大
权限只读,或限定单表、单目录生产库读写、管理员账号
环境沙箱、数据副本直接连生产环境
动作只生成草稿,等人确认直接发送、执行、支付
可逆性软删除、可撤销硬删除、对外发布
范围单用户、单条记录全量批量操作
兜底超时熔断、额度限制无限重试、无人值守

怎么提前把它画小

从业者上线一个 Agent 前,值得把下面几条当默认动作:

1. 最小权限:默认只读,写权限单独申请;给 Agent 一个专用账号,别用你自己的。

2. 先干跑(Dry Run):在副本或测试环境跑通,动作先"预演"一遍再真的执行。

3. 可逆优先:能做草稿箱就不直接发,能软删除就不硬删。不可逆的动作一定要人确认。

4. 限额与熔断:一次最多发几封邮件、最多改几行数据,超阈值就停。

5. 留痕与回滚:每个动作有日志,出事后能定位到哪一步、能退回去。

对普通职场人,这套思路同样好用:接受一个 AI 工具替你干活之前,先问一句"它能碰到我哪些东西、碰坏了能不能收回来",答案往往决定了你敢不敢按下那个授权按钮。

最后留一个自检问题,一句话就能用:如果它今天彻底跑偏了,最坏会怎样? 把答案写下来——那就是你的爆炸半径。写不出来,说明它还没想清楚。

AI 生成本文由 AI 基于公开信息自动生成,仅供参考。