跳到主内容
快讯直播
AI智模界
AI产品

OpenAI 为 ChatGPT 与 Codex 引入文本水印

据 The Verge 报道,OpenAI 正在为 ChatGPT 和 Codex 加入文本水印(text watermarking)能力。这意味着 AI 生成内容的标识问题,正从图像、音频等模态进一步延伸到使用最广泛的文本与代码场景,归入 AI 产品层面的功能更新。

文本水印通常指在模型生成过程中对词元选择施加不易察觉的统计偏置,使输出携带可被专用算法检测的隐藏信号。它与显式标注、元数据标记不同,目标是在内容被复制、转发之后仍能追溯来源。难点也正在于此:任何检测方案都必须面对改写、翻译、摘要、人工润色等后处理造成的信号衰减,同时还要避免把人类撰写的文本误判为机器生成。

为什么重要,可以从三个角度看:

一是溯源。内容平台、出版方与招聘、教育等场景,都希望以较低成本判断一段文字是否由模型生成。

二是规范。围绕 AI 生成内容标识的监管要求正在成形,前述报道的链接路径也指向欧盟《人工智能法案》这一背景。

三是产品面。ChatGPT 对应通用对话,Codex 对应代码生成,后者的水印尤其敏感——生成的代码常被直接并入企业仓库与工具链,任何可检测的标记都可能牵动开发者对代码归属、可维护性与可靠性的判断。

对 AI 从业者来说,接下来值得观察三点:水印在真实使用强度下的检出率与鲁棒性;对正常输出质量与文本分布是否带来可感知影响;检测能力是否对外开放、以何种形式开放。

目前公开信息仍然有限,具体实现方式与上线节奏有待官方进一步说明。

AI 生成本文由 AI 基于公开信息自动生成,仅供参考。