OpenAI 公布文本水印分阶段方案:API 可选用,欧盟产品尚待推出
OpenAI 10 月 5 日发布文本来源标记计划,同时承认短文本和改写内容更难检测。欧盟透明度规则提供背景,但不能仅凭产品公告判断其法律合规状态。
OpenAI 于 10 月 5 日公布文本水印方案:从当天起,全球 API 客户可以对部分模型选择启用文本水印,默认仍为关闭。公司表示,未来数周将在欧盟地区为符合条件的 ChatGPT 和 Codex 文本输出逐步加入不可见水印;这不是全球默认开启的公告。上述时间与范围均来自 OpenAI 的发布说明,实际覆盖情况仍需在推出后核实。
公司将其方案称为 textGrain,表示检测器会寻找模型用词选择中留下的统计信号。检测工具的申请目前面向获批准的研究人员和专业机构,尚未对公众普遍开放;技术报告将继续更新,开放源代码也仍是计划而非已完成事项。读者因此不能把“存在水印技术”理解为现在就能可靠检查任何一段网络文字。
OpenAI 自行公布的测试说明了边界:在所述心理学类样本、误报率目标为 1% 的条件下,约 200 词元段落的检出率约为 80%,400 词元段落约为 95%;数学等措辞自由度较低的内容表现更差。其另一项 400 词元测试中,把 10% 的词替换为同义词后,检出率由约 92% 降至 66%。这些数字是特定条件下的项目方结果,不等于日常文本、翻译或二次编辑内容的通用准确率。
欧盟《人工智能法案》第 50 条要求相关提供者在技术可行范围内,对生成或操纵的文本等内容作机器可读标记并使其可检测;条文同时列有适用范围和例外。欧盟委员会已发布解释透明度义务的指南。OpenAI 的公告可以作为观察企业如何回应规则的材料,但本文没有对其产品进行独立测试,也不能从一次公告推出它已满足所有法律要求。
资料来源与责任信息
已完成人工复核。