欧盟人工智能法案,即《条例(欧盟)2024/1689》第 50 条的透明度义务自 2026 年 8 月 2 日起适用。目前关于它的文章,大多要么是整部条例的摘要,要么是写给已经熟悉条例的读者的法律分析。本文两者都不是,而是从一个内容发布团队的角度,简单说明第 50 条到底要求什么。
变化是什么,何时开始
人工智能法案于 2024 年生效。它的各项义务并非同时启动,而是按照条例本身规定的时间表分阶段适用,2026 年 8 月 2 日正是第 50 条透明度义务开始适用的日期。
那天早晨规则本身并没有任何新内容,文本自 2024 年起就已公开。改变的是义务已经生效,因此问题从规则会怎么说,转变为你能就自己的内容拿出什么来证明。
第 50 条约束谁
该条把义务分给两种角色,这种划分很重要,因为大多数团队明确属于其中之一。
提供者是把人工智能系统投放市场的一方。如果你开发或提供生成式模型,或基于其构建的产品,标记义务就在你身上:输出必须以机器可读的方式,可被识别为人工生成或经过处理。
部署者是使用此类系统并发布结果的一方。把营销文案交给模型处理的市场团队是部署者,制作客户交付物的代理机构、生成插图的出版方、在辅助下撰稿的内部内容团队同样如此。只要你发布输出,披露义务就在你身上。
实际上,几乎所有内容或市场职能都是部署者而非提供者。这一点值得在内部讲清楚,因为团队常常以为义务属于他们所用工具的供应商。
什么算人工智能内容
范围比多数人预想的更广。第 50 条涵盖合成的音频、图像、视频和文本,并不局限于明显由模型生成的插图。
其中两类被明确点名。深度伪造,即为了类似真实人物、地点或事件而生成或处理的图像、音频或视频内容,会触发部署者的披露义务。为向公众通报公共利益事项而发布的、由人工智能生成或处理的文本同样如此。
后一类涵盖的企业出版物比表面看上去更多。市场评论、关于监管变化的文章、涉及公共健康或消费者安全议题的解读:这些并不明显属于新闻报道,却仍可能落入一项围绕"告知公众"而撰写的义务之中。
标注究竟意味着什么
这里有两件事常被混为一谈,把它们区分开来就是大部分工作。
第一是机器可读的标记。它存在于文件本身。下游系统、平台、验证工具或另一个模型,必须能够读取该文件并判定它是人工生成或经过处理的。这项义务落在提供者身上。
第二是人能看见的披露。这是出现在受众接触内容那一刻的提示。它必须在那一刻触达对方,而不是躺在三次点击之外的政策文件里。这项义务落在部署者身上。
可见的提示无法满足机器可读的要求,而机器可读的标记本身也不会告诉读者任何事情。这是面向不同对象的两项不同义务,做到其中一项,并不等于自动做到了另一项。
几乎所有人都忽略的一点
标注是关于内容的一项陈述,而不是关于什么被制作、由谁制作、何时制作的记录。
这个区别一直不显眼,直到有人有理由去检验这项陈述,而这个人很少是监管机构。更常见的是正在推进供应商问卷的客户、合同争议中的对方当事人,或要求你为几个月前所作声明提供依据的平台。
到那时,标注不再是答案,而成了被质疑的对象。接下来被要求的是证据:发布的是哪个版本、从草稿到发布之间经过了什么、这在什么日期成立。回答这些问题需要的是记录,而不是一条由你掌控、随时可改的提示。
大多数团队会拿出手头已有的东西:文件修改日期、邮件往来、项目管理记录、云端版本历史。这些都掌握在作出陈述的一方手里,也都能被这一方修改。它们在内部很有用,但一旦其价值取决于别人是否相信,就变得薄弱。
周一之前要理清什么
三个问题,按此顺序。开始处理它们都不需要先取得法律意见。
我们发布了什么?不是页面上现在显示的内容,而是实际发出去的东西、哪个版本、哪一天。如果三个月前的一篇内容没人答得上来,那就是第一个缺口。
什么经手过它?哪些部分是生成的、哪些由模型修改、哪些由人撰写。在大多数团队里,诚实的回答是模型在流程中的某处提供了帮助,而结果由人完成,这是完全值得声明的事实。
我们能证明吗?不是声称,而是向一个没有理由相信你、也无法访问你系统的人证明。
如果第三个问题的答案是否定的,那么在被问到之前解决,比事后补救要好。一份带日期、可由第三方独立核验的记录,说明发布了什么以及是如何产出的,就能补上这个缺口,而且在发布当时创建它,远比一年后回头重建容易得多。





