OpenAI 在官网发布题为《Our approach to EU text provenance rules》的文章,说明其面向欧盟文本溯源(text provenance)监管规则的应对思路。该内容被归入政策类议题,指向欧盟在 AI 生成内容透明度方面不断收紧的合规要求。
所谓文本溯源,是指让机器生成的内容在传播链条中可被识别、可追溯来源。图像与音视频领域已有内容凭证、隐式水印等业界实践,但纯文本长期被视为最难的一环:文本缺少稳定的载体元数据,水印容易在改写、翻译、截断后失效,内容一旦被复制粘贴,便脱离原平台的管控边界。
因此,OpenAI 此次公开自身做法,意义不止于一份合规说明。对开发者而言,它可能预示未来模型输出层面标识机制的形态;对内容平台与出版机构而言,关系到如何判断一篇稿件是否由模型生成;对整个行业而言,各家厂商在文本水印与内容凭证上的技术路线能否互认,将决定"溯源"走向通用标准,还是碎片化为互不兼容的孤岛。
同时需要注意,文本溯源本身伴随误判风险——把人类写作错标为 AI 生成,或把生成内容判为人类原创。规则落地时如何设定精度门槛、如何界定各方责任,仍是各方博弈的焦点。OpenAI 此次发声,是其在欧盟监管框架下的一次公开表态,后续具体技术方案与实施节奏值得持续关注。
