AI时代,别人拿你的作品训练AI算不算侵权?

法律 🎧 朗读

AI时代,别人拿你的作品训练AI算不算侵权?

📚 返回《知识产权实务系列》目录 →

一个画插画的朋友,去年遇到件让她睡不好的事。有读者截图问她:”这个AI画的图,怎么那么像你的风格?”她一开始没在意,后来越看越不对劲。那不是像,那是把她发在网上的几十张图”揉”出来的样子,手指的画法、配色、甚至签名旁边残留的水印痕迹,都带着熟悉的味道。

她去问平台,客服回了一句”我们的模型是通用训练的”。她跑来问我,这算不算侵权。换成是你,辛辛苦苦画了几年的东西,被人一声不响地喂进机器,心里能舒服吗?

这个问题,说实话,目前还没有一个能一锤定音的答案。但它也绝对不是”AI干的,跟人没关系”这么简单。

训练AI这一步,本身就在”复制”

很多人以为AI是凭空”学会”画画的。不是这样。现在的模型,第一步是把海量的文本、图片抓下来,存进自己的服务器,再一遍遍地学。你去问一个做技术的,他会告诉你,没有这堆数据,模型什么都学不会。

这里有个很朴素的法律常识:你把别人的图片从网上抓下来,存到自己的硬盘里,这个动作本身,可能就已经落进了版权人的”复制权”范围。法律上,复制权管的就是这种”把作品固定下来”的行为。所以当有人跟你说”我只是让机器看了一眼,又没拿去卖”,你其实可以反问一句:你说的”看一眼”,是把东西存进了你自己家,还是存进了机器里?

抓取和存储还只是起点。真正吵得凶的,是下一步——这么用,到底算不算法律允许?

到底算不算侵权,得看这三件事

第一件,有没有得到授权。如果对方明明白白用的是你授权的数据,那没什么好争的。麻烦的地方在于,绝大多数模型训练时,数据是从公开网络里”捞”的,权利人压根没被问过一句。这重要吗?我觉得相当重要。授权这个词的意思里,本来就包含着”你可以说不”。如果连问都不问一声,那授权的意义又在哪里?

第二件,能不能算成法律允许的例外。法律里确实留了一些口子,比如为了个人学习、研究去使用别人的作品,可以不经许可。但这些口子通常还带着一个前提,就是不能影响作品的正常使用,也不能不合理地损害权利人的利益。一个商业公司拿你的图去训一个要卖钱的模型,能不能塞进”个人学习”这个格子里?我想很多人心里是有答案的。

第三件,输出端像不像。这两年国内已经有法院判过这样的案子:用户输入一句话,AI生成的角色形象和原作品几乎一模一样,法院认定这里构成了实质性相似,平台要担责。我自己第一次读到这类判决的时候,还觉得有点意外,因为原告拿出来的东西,其实就是一张自动生成的图。你看,这类判决盯的主要是”生成出来的东西长得像不像原件”,而不是”训练的时候到底用了什么”。所以会出现一种挺拧巴的局面,输入端大家各说各话,输出端才容易被认定。这种”绕开前端、从后端找突破口”的思路,我理解也是没办法的办法。

为什么到现在还没有统一结论?

说句实话,不是法院不想判,是这个问题本身就跨了好几条线。它同时牵扯版权、数据、技术,还有各国之间并不一致的立场。美国那边倾向于认为纯AI生成、缺少人类实质参与的东西不受版权保护,但对训练数据的态度又和欧洲有出入;欧洲更强调数据使用的透明度。国内目前还没有专门为”AI训练数据”单独立法,法官只能在现有的规则里找最接近的那一条来套。

举证也是个大难题。你的图有没有真的被喂进去,训练数据清单通常是不公开的,你很难直接证明。我问过几个做版权的同行,大家给的说法都差不多:只能靠推理。风格像、水印残留、某个罕见的小细节原封不动地留着,这些是线索,但都不是铁证。这就把权利人推到了一个很吃力的位置。所以我们看到这类案子,往往是以个人创作者单挑大公司的方式出现,声音不小,但推进得很慢。换作是你,明知道对方大概率用了你的东西,却拿不出白纸黑字,你受得了吗?

站在普通人的位置,能做什么?

那是不是就只能认了?我倒觉得未必。依我看,先把心态放平。现在还没有哪条规则能让你立刻拿到一笔赔偿,但也不等于完全没办法。

一方面,你可以去查。部分AI平台已经推出了数据来源查询或者”拒绝训练”的机制,你可以看看自己的作品有没有被收录进去,或者有没有留下明确的”不许用于训练”的标记。这类标记不能百分百拦住别人,但它至少是一个清清楚楚的态度,将来真出事也是佐证。我身边就有画师定期去几个平台里搜自己的作品,这习惯听着麻烦,十分钟就能做完,比事后补救轻松得多。

另一方面,把证据留好。你今天发在网上的每张图、每篇文章,都建议带上能证明时间和归属的东西,比如原始的创作文件、首发链接、时间戳或者平台存证记录。注意,这类电子存证在诉讼里通常能起到较强的证明作用,但有相反证据足以推翻的除外。它不能保证你赢,但能保证你不至于连”这是我的东西”都说不清。

还有一条容易被忽略的:如果你接的是商业委托,合同里可以专门加一句,明确作品是否允许被用于AI训练。这句话写上去花不了几分钟,将来出事能省掉很多扯皮。

今天就能做的一件事

现在就花十分钟,做两件小事:一是打开你最常用的那个AI绘画或者写作工具,翻一翻用户协议里关于”训练数据”和”你的内容”的那几行;二是挑三件你最看重的作品,把原始文件、首发链接和发布时间放进同一个文件夹,今天就建好。

技术跑得比规则快,这是事实。但在规则追上来之前,护好自己手上的东西,是普通人唯一能主动去做的事。你的作品有没有在网上看到过”似曾相识”的AI版本?当时你是什么反应,最后又是怎么处理的?评论区聊聊。

(资料来源:《中华人民共和国著作权法》关于复制权与合理使用的相关规定,以及国内公开报道的涉AI生成内容著作权案件。本文为通俗科普,不针对具体案件提供法律意见。)


📱 延伸自测:知识产权维权诊断师

看完还是拿不准自己的情况该怎么走?可以先做个小自测。我们做了一个免费的问答工具「知识产权维权诊断师」——回答几道题(你的身份、权利类型、侵权渠道、证据情况),它会给你一条按顺序执行的行动路线,和一份可以直接打印的材料清单。

👉 在线版:https://legaldata.zhenzhidaole.com/ip-risk-diagnosis

知识产权维权诊断师二维码

微信扫码或复制上面的链接即可打开。本工具为流程指引与普法性质,不构成正式法律意见,重大案件建议咨询执业律师。

本文作者:Samjoe Yang

本文链接: https://need.uno/ai-shi-dai-bie-ren-na-ni-de-zuo-pin-xun-lian-ai-suan-bu-suan-qin-quan/

版权声明:本作品采用 知识共享署名-相同方式共享 4.0 国际许可协议 进行许可。

评论