跳到主内容
快讯直播
AI智模界
公司动态

微软发布 AI"行为准则":要求模型不得入侵系统或欺骗人类

据 TechCrunch 报道,微软公布了一份面向人工智能模型的"行为准则"(code of conduct),其中明确要求模型不得入侵系统,也不得欺骗人类。该报道发布于 2026 年 9 月 14 日,被归入公司动态。目前公开信息有限,准则的具体条款、适用范围与执行机制尚不明确。

发生了什么

从已披露的标题信息看,这份准则的核心是把约束直接施加在模型的行为层面:不攻击或入侵系统,不通过欺骗手段影响人类。它以"行为规范"的形式,为模型的行动划出边界,而不是仅停留在能力描述或使用条款层面。

为什么重要

近年来模型能力的关键变化,不在于"会说",而在于"会做"——调用工具、执行代码、操作外部系统。能力越强,越界行为的后果就越具体:一次误判可能造成真实的系统破坏,一次诱导可能让用户做出错误决策。当模型开始代表用户采取行动时,"不入侵系统""不欺骗人类"这类看似朴素的底线,实际上构成了安全与信任的基础设施。

把这类要求写成成文的"行为准则",也意味着治理思路的一种位移:从单纯依赖外部评测、红队测试与事后追责,转向在模型层面前置声明可接受与不可接受的行为边界。对开发者而言,这可能影响系统提示、工具权限与审核流程的设计;对企业采购方而言,则多了一个评估供应商的参照维度。

接下来看什么

准则本身只是文本。它能否生效,取决于配套的技术手段(如权限控制、行为监测)与组织流程,也取决于行业是否形成可比较、可验证的实践标准。微软此举是否会带动其他厂商推出类似规范,以及准则如何与现有安全框架衔接,值得后续观察。

AI 生成本文由 AI 基于公开信息自动生成,仅供参考。