大家好,首先做一个简单的自我介绍,本人目前从事数据安全行业,之前有过网络安全、等级保护的工作经历。现在个人的目标是成为一名数据安全合规方向的资深人士。我会不定期解读输出一些数据安全、个人信息保护、AI类国家标准文件的解读文章。在帮助其他人了解标准文件的同时也提高自己的文章输出能力。因为本人也是才开始学习解读文件,存在错误的地方欢迎大家在评论区留言共同探讨,也欢迎私聊~。

本次学习的是AI内容标识文件《人工智能生成合成内容标识办法》(下文简称《内容标识办法》),我之所以选择第一次学习本文件,是因为本办法对应的标准《GB 45438-2025 网络安全技术 人工智能生成合成内容标识方法》(下文简称为45438文件)是强制性国家标准,且办法里也明确规定适用于所有提供或传播AI生成合成内容的服务提供者,适用范围广,且具有法律强制力。

接下来我会从文件定位、背景、结构、关键词的维度带大家一起看这篇文章,我会将每条正文内容转换成自己的理解。下面的原文为图片,解读内容为文字的形式呈现,建议大家最好先读一下原文图片,再看解读文字。

一、文件定位

首先我们先看这篇文件的定位,也就是开头部分,由国家互联网信息办公室(网信办牵头)、工信部、公安部、国家电视广播总局四部门联合发文,重量可想而知。主旨是为规范人工智能生成合成内容添加标识而制定,让大家更容易分清AI生成的内容。文件名称以“办法”结尾,属于规范性文件(拥有法律效力),发文日期为2025年3月7日。

二、拆结构看背景

一般文件(包括本文)都分为总-分-总结构,第一、二条、十三条、十四条为总,中间第三条至十二条为中间结构。我们先聊聊开头和结尾的内容。

第一条、第二条(总)


开头第一条说明本办法的依据来源,第二条说明本办法适用范围,服务提供者开展人工智能生成合成内容标识的均适用本办法。

文件背景

我们通过文件开头的文件依据,推导出本文背景:

文件依据链路如下图所示:

从上往下看,上层的依据是《生成式人工智能服务管理暂行办法》(下文中简称为《AI管理暂行办法》)、《互联网信息服务深度合成管理规定》(下文简称《深度合成管理规定》)。本办法属于对《AI管理暂行办法》第十二条的细化。

另外因为《深度合成管理规定》是关于深度合成技术方面的规定,毕竟深度合成也包含在AI合成中,所以与本办法也有关联。然后本办法《内容标识办法》与45438文件属于政策+标准的组合。45438文件负责细节落地。

第十三条、第十四条(总)

最后两条第十三、十四条说明了处罚依据实施日期,由2025.9.1日起施行。

三、正文内容(分)

第三条

第三条是解释显式标识、隐式标识的含义。这里大白话翻译一下,显式标识的意思是可以被用户看到、听到的标识。隐式标识在内容上是不会直接被用户看到、听到的

第四条(服务提供者)

看第四条前,这里需要注意本文的服务提供者的范围,第二条已说明,是指符合《互联网信息服务算法推荐管理规定》、《深度合成管理规定》、《AI管理暂行办法》规定的网络信息服务提供者。比如《算法推荐管理规定》里的利用生成合成类算法技术向用户提供信息的主体,《深度合成管理规定》里的服务提供者指提供人脸生成、图像生成、篇章生成等技术的组织、个人。

从全文的角度来看,服务提供者与内容传播者的主体并不是独立的,像抖音、微信、B站这类平台, 两端义务叠加,全都要履行。

接下来言归正传,第四条内容需要让服务提供者添加显式标识,咱们先看《深度合成管理规定》第十七条第一款有哪些情形,然后在看符合情形的需要如何添加显式标识。

《深度合成管理规定》第十七条第一款总结一下,意思就是可能导致公众混淆或者误认的,应当进行显著标识,并且罗列了对应场景

然后再看本条:有可能导致公众混淆或者误认的场景时,需要在文本、音频、图片、视频、虚拟场景的特点位置添加显式标识。需要注意的是本文第四条的前两个要求里,有个“或者”二字,说明这是两种情况,需要在两种里最少选一条。再就是第四第五个要求里也有个“可以”二字,可以理解成在“可以”前面的内容是必须执行的,“可以"后面的内容是选择性执行的。

第五条

第五条是说的隐式标识,在读完之后的总结就是,所有AI生成合成内容都需要添加隐式标识。

接下来我们按照顺序看第一句,服务提供者都需要按照《深度合成管理规定》第十六条的规定内容如下图所示:

将上图内容转移到第五条内容上,也就是说:提供者需要对生成或编辑的信息内容,都应该采取技术措施添加不影响用户适用的标识。也就是都需要添加上隐式标识。隐式标识的具体包含内容在45438文件中有具体说明。

这里多说两点,隐式标识分为文件元数据隐式标识和内容隐式标识(也就是数字水印形式)两种,文件元数据隐式标识是必须的,数字水印形势是加分项,鼓励提供者添加的。

然后文件的元数据是指描述数据本身的一些特征和背景,比如一段数据的格式、长度等属性数据。通俗来说就是“关于数据的数据”。举个例子:一个文件的文件名、文件大小(占多少KB/MB)、文件类型(.jpg, .pdf, .mp4)、位置信息(文件的存放路径)等。

我又自己动手验证了一下,大家推荐一个可以识别AI图片的网站,可以检测文件元数据(EXIF) 网站名:exif.oneding.tech

图穷-在线EXIF图片信息提取

AI生成的图片放到网站里检测,内容如下:

在版权信息里,会有一个“AIGC”的标识,有这个标识就代表AI生成合成的内容了,但是这只是代表大部分,我安装了智能体,我让智能体帮我把图片去掉AI生成的内容后,这个网站就检测不到了

第六条(内容传播者)

第六条说的是内容传播者的规定,也就是我们生活中看到的抖音、快手等传播内容的平台应该做的事情。本条是全文中比较难以理解的部分,主要是前三中情况。

前三条需要认真阅读和理解,特别注意“属于”、“可能”、“疑似”这几个字眼。已经在图片中圈出。

1、内容传播者需要核验,核验文件元数据中明确有隐式标识的要添加提示标识提醒“属于生成合成内容”;

2、未核验到元数据中的隐式标识,但是用户声明里声明了(第八条服务提供者需要在声明中明确方法),要添加显著提示标识提醒 “可能为生成合成内容”;

3、未核验到元数据隐式标识的,用户声明也没有的,但是平台检测到合成痕迹的。为 “疑似生成合成内容”。

上述三种情况均在内容发布周边添加显著提示标识。

第七条(分发平台)

这一条是关于分发平台的,比如说手机上的应用商城就算是分发平台,在提供AI生成合成服务的应用程序上架时,需要核查生成合成内容标识的相关材料

第八条

服务提供者要在用户协议中明确生成合成内容,上面第六条中的内容传播者核验内容里就有本条内容。

第九条(用户)

用户可以向服务提供者申请没有显式标识的生成合成内容。服务提供者提供之后要留存相关日志6个月以上。

第十条

第十条主要是对于用户的,在平台发布内容时应该主动使用平台提供的标识。下面起到警示作用,组织和个人不得恶意破坏生成合成内容标识。

第十一条

目前我查到的就是45438文件,对应本办法,而且值得注意这是强制性国家标准文件。

第十二条

要求服务提供者在进行算法备案安全评估时,必须一并提交标识合规的相关材料。标识信息共享是为了更好的快速定位责任主体。

安全评估相关标准:《生成式人工智能服务安全基本要求》

算法备案相关标准:《互联网信息服务算法推荐管理规定》

大模型备案相关标准:《生成式人工智能服务管理暂行办法》

四、总结

本文章的正文内容已经结束了。总结一下,学习这种政策类、规范类的文件并没有想象中的简单,甚至可以说是费时,本以为这十几条的文章会非常简单。可是想要深入吃透其中的所有内容很耗精力,写完之后还让我同事帮我审了一下,在此感谢她哈哈哈。

个人建议,在学习时可以把《内容标识办法》与45438文件各读一遍之后,两个相互搭配着再过一遍。前者是政策框架,后者是强制性国家标准,想要吃透的话两者缺一不可。

最终通读全文加整理脑图,我将中间部分划分为三大部分:服务提供者、内容传播者、应用商店与用户(已在目录中标明)。本文最后面是我自己总结的脑图,供大家快速了解中间重要部分(花了一段时间,喜欢的话点个赞支持下~)。

另外我在附件中除了本文还上传了《生成式人工智能服务管理暂行办法》、45438文件、《深度合成管理规定》,以供大家参考。

Logo

有“AI”的1024 = 2048,欢迎大家加入2048 AI社区

更多推荐