一句话定义:多方——通常是政府与前沿 AI 实验室,或若干国家之间——共同签署、但不具备法律强制力的安全承诺文件。签了就要照做,可违反它不会被告上法庭,也不会被罚款。
打个比方
这很像小区电梯里贴的"深夜不装修"公约。大家签了名,靠的是面子、邻里关系,以及"你吵我、我也可以吵你"的隐性互惠。而《噪声污染防治法》是另一回事:有执法部门、有投诉渠道、有罚款,晚上真开工会被处罚。两者的差别不在措辞漂亮与否,而在违约成本——公约的违约成本约等于社死,法律的违约成本是真金白银。
三个容易混淆的东西
| 谁制定 | 违约后果 | 典型形态 | |
|---|---|---|---|
| 企业自愿承诺 | 企业自己 | 声誉受损 | 官网上的"负责任 AI 原则" |
| 非约束性安全协议 | 政府与企业、或多国共同 | 声誉受损,可能被排除在后续磋商之外 | 联合声明、承诺在特定能力阈值前做安全评估 |
| 硬监管(如欧盟 AI Act) | 立法机关 | 罚款、禁售、限制市场准入 | 设监管机构、要求合规审计 |
关键差异是:自愿承诺是单方表态,企业自己解释、自己监督;非约束性协议多了"共同文本"和外部见证;硬监管则把义务焊进了市场准入条件——不合规就做不了生意。
为什么容易被批评为形象工程
放在"超级智能(superintelligence)"的语境下,批评尤其集中:
1. 阈值自我申报。协议常写"当模型能力接近某个危险水平时暂停开发",但危险水平由谁判定?往往还是签署方自己。相当于让考生自己划及格线。
2. 措辞留白。"尽合理努力""在技术可行范围内"这类表述,把实际执行力度交回给签署方自由裁量。
3. 缺少第三方审计与披露义务。外部研究者拿不到红队(red team)测试结果,也无从验证承诺是否兑现。
4. 声誉惩罚太轻。对资金充裕、竞争白热化的前沿实验室,一次公关风波的成本,往往低于落后竞争对手半年。
于是它容易变成一场双赢的公关:政府说"我们在管",企业说"我们负责",双方以极低成本拿到形象分,实质约束却接近于零。
那它有用吗
有,但价值不在"管住谁"。它的真正作用是降低协商成本:让立场不同的多方先在同一份文本上签字,形成基线共识,为日后立法提供模板——行业标准常常先于法规出现。超级智能这类领域技术迭代快于立法周期,硬监管可能刚落地就过时,柔性协议保留了调整空间。取舍也正在这里:灵活性与可执行性很难同时拿满。
实用建议
看到"某方签署了 AI 安全协议"的新闻,追问三件事:谁定阈值?谁做审计?违约怎么办?三个都答不上来,就当它是一份意向书,而不是一条红线。具体条款与最新签署情况,以相关方官方页面为准。
