我之前写过一句话:「代码就是语言,而语言从来不属于任何人。」
今天我把这句话往前推一步:AI生成的代码,不属于任何人。因此它无所谓开源。
你不能开一个你从未拥有过的源。
壹|小孩子随手画的画
一个五岁的小孩,拿蜡笔在墙上画了一只猫。歪歪扭扭的,耳朵一只大一只小,尾巴翘到了天上。
这幅画有版权吗?
有。
不是因为它画得好。是因为那只猫是那个小孩从自己脑子里拿出来的。她的手,她的眼睛,她五岁的大脑里对猫的理解。这些东西加在一起,形成了一个独一无二的产物。没有人,没有任何东西,能在同一个瞬间产出完全一样的那只猫。
版权保护的不是质量。是人格痕迹。
AI没有人格痕迹。
你给AI一个prompt:「画一只猫。」它画出来了。很好看。耳朵对称,尾巴优雅,毛色均匀。
但你换个时间、换个随机种子、换一台机器,同样的prompt,产出完全不同的猫。
哪一只是「它」的猫?
都不是。都是训练数据里几百万张猫的图片的概率叠加。AI没有「想画一只猫」的意图。它只是在几千万个参数空间里找到了一个让你满意的概率分布。
小孩子画的猫,背后有一个五岁的人。AI画的猫,背后有几百万个人。那几百万个人从来没有同意让他们的猫被合成在一起。
你说这幅画属于谁?
属于那个写prompt的人?他只是说了一句话。说一句话不等于创作。我告诉你「画一只猫」,你画了,画是你的,不是我的。
属于AI?AI不是法律主体。它不能拥有财产,不能签合同,不能被起诉。
属于训练数据里的那几百万人?他们甚至不知道自己的作品被拿去训练了。
所以它不属于任何人。
贰|美国版权局已经说了
2023年2月,美国版权局明确裁定:纯粹由AI生成的作品,不受版权保护。
2025年,版权局进一步澄清:如果人类对AI的输出有「足够的创造性控制」,比如反复修改、重新组合、注入自己的表达,那么人类贡献的部分可以受版权保护。但AI自动生成的那部分,依然不行。
这条线划得很清楚。不是「用AI就不能有版权」。是「AI生成的那一部分,你没有版权」。
问题在于,这条线在实操中几乎不可能划清楚。
你用AI写了一段代码,然后你改了三个变量名,加了两行注释,删了一段冗余逻辑。这段代码里,哪些是你的,哪些是AI的?
你不知道。我也不知道。版权局也不知道。
你用AI生成了一篇文章,然后你重写了开头,加了一个个人故事,调了段落顺序。哪些是你的?
同样不知道。
当「你的」和「AI的」混在一起无法拆分的时候,整件事就变成了一个灰色地带。而灰色地带的最大受益者,不是你,是那些拥有AI模型的公司。
你现在用AI生成的每一行代码、每一篇文章、每一张图,法律上你都不完全拥有它。你只是拥有你那部分「创造性贡献」。但AI公司拥有模型,拥有训练数据的协议,拥有生成过程的技术细节。
你是个租客。你以为你在建房子,其实你在帮房东装修。
叁|版权保护的从来不是创作
有人说,版权保护的是创作者的权益。
不是。
版权保护的是资本的权益。
一个人花三年写了一本书,版权属于他。但他签了出版合同之后,版权就属于出版社了。他拿版税,出版社拿版权。谁赚得多?出版社。谁有权力决定这本书的命运?出版社。
版权从诞生那天起,就是资产阶级法权。它保护的不是创作行为本身,而是创作成果的排他性商业利用权。
这就不难理解为什么AI厂商对版权的态度如此分裂了。
训练阶段,他们无视版权。拿全互联网的数据去喂模型,作者不同意?不好意思,合理使用。你的画、你的代码、你的文章,变成了训练数据里的一行梯度,连署名都没有。
产出阶段,他们强调版权。你用我的模型生成的东西,受我的用户协议约束。你不能拿去训练竞品模型。你不能声称你是作者。你甚至不一定拥有商业使用权,取决于你用的是免费版还是付费版。
训练的时候,版权不存在。产出的时候,版权又回来了。
法律在这里没有一致性。只有资本的双重标准。
吃进去的时候说「信息想要自由」。吐出来的时候说「信息归我所有」。
我之前写《第三次世界大战已经开打》的时候说过,开源AI是我们唯一的武器。我今天要补一句:当「开源」的定义被资本扭曲之后,这把武器也会变成枷锁。
肆|不能开源的东西
「开源」这个词有一个前置条件:这个东西得有「作者权」。
没有作者权,就没有开源。就像你不能「捐赠」一件偷来的东西。
AI生成的代码,它的训练数据来自全人类。GitHub上几千万个开源仓库,Stack Overflow上几亿条问答,全世界的博客、文档、教程。这些东西被AI吃进去,消化成参数,然后吐出一段「新」代码。
这段新代码的每一行,都是那几亿行旧代码的概率投影。你说它是原创?它连训练数据里每一行代码的license都遵守不了。GPL的代码被喂进去,生成出来的代码不标GPL。MIT的代码被喂进去,生成出来的不保留版权声明。
GitHub Copilot已经被起诉了。 原因就是它有时候会原封不动地吐出训练数据里的代码片段,连license都不带。你用Copilot生成的代码,可能正在侵权,但你不知道。
你用AI生成一段代码,然后你把它「开源」了。
你开源的是什么?是你写的部分?还是AI从训练数据里偷来的部分?你分得清吗?分不清。
Getty Images诉Stability AI,核心争议就在这里。Stability用Getty的图片训练模型,生成的图片里甚至残留着Getty的水印。你说这是「学习」还是「复制」?人类画师看了一万张画之后画出自己的画,那叫学习。AI看了同样一万张画之后产出一张包含原水印的图,那叫抄袭的证据。
区别在哪里?人类画师看画的时候,不会把原作的像素值直接存进脑子里。AI训练的时候,梯度下降的每一步都在修改参数,这些参数是对训练数据的数学编码。说它「学习」了,不如说它「压缩」了。把几十亿张图压缩成几百亿个参数。需要的时候再解压出来。
你把解压出来的东西标上「MIT License」,然后说「我开源了」。
你开的是什么源?你解压了别人的数据。
把偷来的东西送人,不叫开源。叫销赃。
伍|马车车夫的类比是错的
总有人说,AI替代创作者,就像汽车替代马车。马车车夫转型当了司机,创作者也该学会用AI,别抱怨了。
这个类比错在哪里?
汽车替代马车,替代的是一个功能:从A点到B点。马车车夫的技能被淘汰了,但人的价值没有被否定。他可以从赶马变成开车。他的经验、判断力、对路况的理解,全部可以迁移。
AI替代创作者,替代的不是功能。是人的价值本身。
AI复制声音,复制容貌,复制创作风格,复制劳动成果。它不是让你用更快的方式完成同样的工作,而是用你的工作成果去训练一个能替代你的模型。
马车车夫转行当司机,是因为汽车需要人开。但AI不需要你来「开」。你那个prompt,换一个人写,效果差不多。你花的三年学习,AI三个月就用训练数据覆盖了。
有人说,这是先进生产力淘汰落后生产关系。
不对。
刀能砍瓜切菜,也能砍人。刀有砍人的能力,不代表可以砍人。法律限制你用刀砍人,不叫限制刀的先进生产力。
AI有能力复制一切,不代表复制一切就是合理的。
再退一步,就算我们承认AI是「工具」,相机也是工具,Photoshop也是工具,为什么相机和Photoshop产出的作品可以有版权,AI就不行?
因为相机拍出来的照片,构图是你选的,光线是你等的,角度是你站的。照片里有你的人格痕迹。Photoshop修的图,每一个笔触都是你的决策。工具放大了你的能力,但产出物里的「你」是清晰可辨的。
AI不一样。你给了一个prompt,然后你等结果。你从四个候选里选了一个。你的「创造性贡献」是什么?写了一句话,然后选了其中一个。这句话任何一个会打字的人都能写。这个选择任何一个有审美的人都能做。
你的人格痕迹在哪里?在prompt里?在选择的瞬间?还是在你事后用「我用了AI」来解释的那个叙事里?
如果你的人格痕迹薄弱到需要用一整篇文章来论证它的存在,那它可能真的不够。
陆|真正的受益者
有人幻想,用AI就能打败剥削自己的资本,实现阶级跨越。
但他们忘了,AI厂商也是资本。
你不是在用AI打败资本。你是在用新资本打败旧资本。而你在这个过程中,只是一个免费的步兵。
B站上有个视频讲得很好:中国网友做AI奥特曼痛殴争议人物的影片,传到外网还艾特本人。日美两边都在骂。然后一堆人说「版权不该保护,这是限制先进生产力的落后生产关系」。
看到没有?这些人在帮AI厂商免费打仗。AI厂商不用出头,自然有一帮信众去攻击传统创作者、去否定版权、去给侵权行为洗地。他们以为自己在推动进步,其实只是资本扩张的炮灰。
AI降低了创作门槛。谁都能用AI写代码、画画、做视频。
但AI同时抬高了权力门槛。真正的高阶技术、算力资源、模型架构,依然掌握在少数公司手里。你只能在资本划定的规则内使用AI。免费版有免费版的限制,付费版有付费版的价格。模型的能力上限,不是你决定的,是厂商决定的。
你的产出越高,对AI的依赖越深。你的依赖越深,你的议价能力越低。你以为你在用工具,工具在用你。
当真正的创作者被淘汰了,普通人向上流动的通道也就堵死了。因为创作曾经是一个不需要资本也能起步的领域。你不需要工厂,不需要设备,只需要一支笔、一台电脑。但现在,连这支笔都是AI公司的。
想想看,一个年轻人,没有背景,没有资源,但他能写。他靠一支笔从底层爬上来了。这条路在AI时代还在吗?AI一秒钟能写十篇,他写一个月才一篇。他的市场在哪里?他的读者凭什么选他?
当「写得快」取代了「写得好」,当「量大管饱」取代了「精心打磨」,写作这条上升通道就被堵死了。而替代它的,是AI厂商提供的订阅服务。
柒|那怎么办
我不是反AI。我自己每天都在用AI。我用它查数据、整理素材、检查逻辑。它是工具。好工具。
但工具就是工具。
你不能因为锤子好用,就声称锤子敲出来的桌子是锤子的作品。
你不能因为AI能生成代码,就声称那段代码有版权,然后把它「开源」。
我的观点很明确:凡AI参与生产的作品,不能有版权,也不能有开源。
因为AI的训练数据是全人类的知识。全人类的知识不属于任何个人和公司。你拿全人类的知识训练出来的东西,不能声称是你的,然后选择「开源」还是「闭源」。
这就像你不能从公共水库取水,装瓶,然后声称你在「开源」这瓶水。
有人说,那AI辅助写作怎么办?人类用AI做工具,产出的东西完全不能保护吗?
我再说一遍:美国版权局已经给了答案。你用AI辅助,你自己的创造性贡献部分可以有版权。AI生成的那部分没有。你改了三个变量名,那三个变量名是你的。剩下的不是。
你说这不公平?确实不公平。但这个不公平的根源,不是版权法太严格,而是AI侵蚀了「创作」和「生成」之间的边界。当工具智能到让「使用工具」和「工具替你完成」变得难以区分的时候,你不能怪法律划不出一条清晰的线。
你得怪那个把线搅浑的人。
谁搅浑的?是谁在鼓吹「AI创作」?是谁在营销「人人都是创作者」?是谁在告诉你「你只要写一句话,剩下交给AI」?
是AI厂商。
他们一边把「创作」的门槛降到零,一边在法律上收割你零门槛产出的版权真空。你什么都没创造,你当然什么都不能拥有。但你不会意识到这一点,因为你沉浸在「我也能创作了」的幻觉里。
幻觉是免费的。版权是收费的。
小孩子随手画的画可以有版权。因为那只猫是她自己想的。歪歪扭扭,但属于她。
AI画的猫没有版权。因为那只猫是几百万个人类画师的作品的概率合成。它不属于那个写prompt的人,不属于AI,不属于AI公司。它属于公共领域。
它从一开始就在公共领域。
你不能开源一个已经在公共领域的东西。你只能承认它在公共领域。
而一旦你承认了,你就必须面对一个更深的矛盾:如果AI产出属于公共领域,那AI厂商凭什么对你收费?他们卖的是公共领域的东西。
这个问题,留给你想。
ps. 我知道这篇文章会得罪人。用AI写代码然后开源的人会不爽。卖AI课程的人会不爽。靠AI生成内容赚钱的人会不爽。但有些话不说,不是不存在。版权的边界,不是靠假装模糊就能解决的。要么面对它,要么被它反噬。


