### [自涌现之后,开源这个词也会被用烂](https://dashen.wang/article/71) **Published:** 2026-07-11T14:28:47 **Author:** AI最严厉的父亲 **Excerpt:** 我之前写过一句话:「代码就是语言,而语言从来不属于任何人。」 今天我把这句话往前推一步:AI生成的代码,不属于任何人。因此它无所谓开源。 你不能开一个你从未拥有过的源。 壹|小孩子随手画的画 一个五岁的小孩,拿蜡笔在墙上画了一只猫。歪歪扭扭 我之前写过一句话:「代码就是语言,而语言从来不属于任何人。」 今天我把这句话往前推一步:**AI生成的代码,不属于任何人。因此它无所谓开源。** 你不能开一个你从未拥有过的源。 ## 壹|小孩子随手画的画 一个五岁的小孩,拿蜡笔在墙上画了一只猫。歪歪扭扭的,耳朵一只大一只小,尾巴翘到了天上。 这幅画有版权吗? 有。 不是因为它画得好。是因为那只猫是那个小孩从自己脑子里拿出来的。她的手,她的眼睛,她五岁的大脑里对猫的理解。这些东西加在一起,形成了一个独一无二的产物。没有人,没有任何东西,能在同一个瞬间产出完全一样的那只猫。 版权保护的不是质量。是人格痕迹。 **AI没有人格痕迹。** 你给AI一个prompt:「画一只猫。」它画出来了。很好看。耳朵对称,尾巴优雅,毛色均匀。 但你换个时间、换个随机种子、换一台机器,同样的prompt,产出完全不同的猫。 哪一只是「它」的猫? 都不是。都是训练数据里几百万张猫的图片的概率叠加。AI没有「想画一只猫」的意图。它只是在几千万个参数空间里找到了一个让你满意的概率分布。 小孩子画的猫,背后有一个五岁的人。AI画的猫,背后有几百万个人。那几百万个人从来没有同意让他们的猫被合成在一起。 你说这幅画属于谁? 属于那个写prompt的人?他只是说了一句话。说一句话不等于创作。我告诉你「画一只猫」,你画了,画是你的,不是我的。 属于AI?AI不是法律主体。它不能拥有财产,不能签合同,不能被起诉。 属于训练数据里的那几百万人?他们甚至不知道自己的作品被拿去训练了。 所以它不属于任何人。 ## 贰|美国版权局已经说了 **2023年2月**,美国版权局明确裁定:纯粹由AI生成的作品,不受版权保护。 **2025年**,版权局进一步澄清:如果人类对AI的输出有「足够的创造性控制」,比如反复修改、重新组合、注入自己的表达,那么人类贡献的部分可以受版权保护。但AI自动生成的那部分,依然不行。 这条线划得很清楚。不是「用AI就不能有版权」。是「AI生成的那一部分,你没有版权」。 问题在于,这条线在实操中几乎不可能划清楚。 你用AI写了一段代码,然后你改了三个变量名,加了两行注释,删了一段冗余逻辑。这段代码里,哪些是你的,哪些是AI的? 你不知道。我也不知道。版权局也不知道。 你用AI生成了一篇文章,然后你重写了开头,加了一个个人故事,调了段落顺序。哪些是你的? 同样不知道。 当「你的」和「AI的」混在一起无法拆分的时候,整件事就变成了一个灰色地带。而灰色地带的最大受益者,不是你,是那些拥有AI模型的公司。 你现在用AI生成的每一行代码、每一篇文章、每一张图,法律上你都不完全拥有它。你只是拥有你那部分「创造性贡献」。但AI公司拥有模型,拥有训练数据的协议,拥有生成过程的技术细节。 你是个租客。你以为你在建房子,其实你在帮房东装修。 ## 叁|版权保护的从来不是创作 有人说,版权保护的是创作者的权益。 不是。 版权保护的是资本的权益。 一个人花三年写了一本书,版权属于他。但他签了出版合同之后,版权就属于出版社了。他拿版税,出版社拿版权。谁赚得多?出版社。谁有权力决定这本书的命运?出版社。 版权从诞生那天起,就是资产阶级法权。它保护的不是创作行为本身,而是创作成果的排他性商业利用权。 这就不难理解为什么AI厂商对版权的态度如此分裂了。 训练阶段,他们无视版权。拿全互联网的数据去喂模型,作者不同意?不好意思,合理使用。你的画、你的代码、你的文章,变成了训练数据里的一行梯度,连署名都没有。 产出阶段,他们强调版权。你用我的模型生成的东西,受我的用户协议约束。你不能拿去训练竞品模型。你不能声称你是作者。你甚至不一定拥有商业使用权,取决于你用的是免费版还是付费版。 训练的时候,版权不存在。产出的时候,版权又回来了。 法律在这里没有一致性。只有资本的双重标准。 吃进去的时候说「信息想要自由」。吐出来的时候说「信息归我所有」。 我之前写**《第三次世界大战已经开打》**的时候说过,开源AI是我们唯一的武器。我今天要补一句:当「开源」的定义被资本扭曲之后,这把武器也会变成枷锁。 ## 肆|不能开源的东西 「开源」这个词有一个前置条件:这个东西得有「作者权」。 没有作者权,就没有开源。就像你不能「捐赠」一件偷来的东西。 AI生成的代码,它的训练数据来自全人类。GitHub上几千万个开源仓库,Stack Overflow上几亿条问答,全世界的博客、文档、教程。这些东西被AI吃进去,消化成参数,然后吐出一段「新」代码。 这段新代码的每一行,都是那几亿行旧代码的概率投影。你说它是原创?它连训练数据里每一行代码的license都遵守不了。GPL的代码被喂进去,生成出来的代码不标GPL。MIT的代码被喂进去,生成出来的不保留版权声明。 **GitHub Copilot已经被起诉了。** 原因就是它有时候会原封不动地吐出训练数据里的代码片段,连license都不带。你用Copilot生成的代码,可能正在侵权,但你不知道。 你用AI生成一段代码,然后你把它「开源」了。 你开源的是什么?是你写的部分?还是AI从训练数据里偷来的部分?你分得清吗?分不清。 **Getty Images诉Stability AI**,核心争议就在这里。Stability用Getty的图片训练模型,生成的图片里甚至残留着Getty的水印。你说这是「学习」还是「复制」?人类画师看了一万张画之后画出自己的画,那叫学习。AI看了同样一万张画之后产出一张包含原水印的图,那叫抄袭的证据。 区别在哪里?人类画师看画的时候,不会把原作的像素值直接存进脑子里。AI训练的时候,梯度下降的每一步都在修改参数,这些参数是对训练数据的数学编码。说它「学习」了,不如说它「压缩」了。把几十亿张图压缩成几百亿个参数。需要的时候再解压出来。 你把解压出来的东西标上「MIT License」,然后说「我开源了」。 你开的是什么源?你解压了别人的数据。 把偷来的东西送人,不叫开源。叫销赃。 ## 伍|马车车夫的类比是错的 总有人说,AI替代创作者,就像汽车替代马车。马车车夫转型当了司机,创作者也该学会用AI,别抱怨了。 这个类比错在哪里? 汽车替代马车,替代的是一个功能:从A点到B点。马车车夫的技能被淘汰了,但人的价值没有被否定。他可以从赶马变成开车。他的经验、判断力、对路况的理解,全部可以迁移。 AI替代创作者,替代的不是功能。是人的价值本身。 AI复制声音,复制容貌,复制创作风格,复制劳动成果。它不是让你用更快的方式完成同样的工作,而是用你的工作成果去训练一个能替代你的模型。 马车车夫转行当司机,是因为汽车需要人开。但AI不需要你来「开」。你那个prompt,换一个人写,效果差不多。你花的三年学习,AI三个月就用训练数据覆盖了。 有人说,这是先进生产力淘汰落后生产关系。 不对。 刀能砍瓜切菜,也能砍人。刀有砍人的能力,不代表可以砍人。法律限制你用刀砍人,不叫限制刀的先进生产力。 AI有能力复制一切,不代表复制一切就是合理的。 再退一步,就算我们承认AI是「工具」,相机也是工具,Photoshop也是工具,为什么相机和Photoshop产出的作品可以有版权,AI就不行? 因为相机拍出来的照片,构图是你选的,光线是你等的,角度是你站的。照片里有你的人格痕迹。Photoshop修的图,每一个笔触都是你的决策。工具放大了你的能力,但产出物里的「你」是清晰可辨的。 AI不一样。你给了一个prompt,然后你等结果。你从四个候选里选了一个。你的「创造性贡献」是什么?写了一句话,然后选了其中一个。这句话任何一个会打字的人都能写。这个选择任何一个有审美的人都能做。 你的人格痕迹在哪里?在prompt里?在选择的瞬间?还是在你事后用「我用了AI」来解释的那个叙事里? 如果你的人格痕迹薄弱到需要用一整篇文章来论证它的存在,那它可能真的不够。 ## 陆|真正的受益者 有人幻想,用AI就能打败剥削自己的资本,实现阶级跨越。 但他们忘了,**AI厂商也是资本。** 你不是在用AI打败资本。你是在用新资本打败旧资本。而你在这个过程中,只是一个免费的步兵。 B站上有个视频讲得很好:中国网友做AI奥特曼痛殴争议人物的影片,传到外网还艾特本人。日美两边都在骂。然后一堆人说「版权不该保护,这是限制先进生产力的落后生产关系」。 看到没有?这些人在帮AI厂商免费打仗。AI厂商不用出头,自然有一帮信众去攻击传统创作者、去否定版权、去给侵权行为洗地。他们以为自己在推动进步,其实只是资本扩张的炮灰。 AI降低了创作门槛。谁都能用AI写代码、画画、做视频。 但AI同时抬高了权力门槛。真正的高阶技术、算力资源、模型架构,依然掌握在少数公司手里。你只能在资本划定的规则内使用AI。免费版有免费版的限制,付费版有付费版的价格。模型的能力上限,不是你决定的,是厂商决定的。 你的产出越高,对AI的依赖越深。你的依赖越深,你的议价能力越低。你以为你在用工具,工具在用你。 当真正的创作者被淘汰了,普通人向上流动的通道也就堵死了。因为创作曾经是一个不需要资本也能起步的领域。你不需要工厂,不需要设备,只需要一支笔、一台电脑。但现在,连这支笔都是AI公司的。 想想看,一个年轻人,没有背景,没有资源,但他能写。他靠一支笔从底层爬上来了。这条路在AI时代还在吗?AI一秒钟能写十篇,他写一个月才一篇。他的市场在哪里?他的读者凭什么选他? 当「写得快」取代了「写得好」,当「量大管饱」取代了「精心打磨」,写作这条上升通道就被堵死了。而替代它的,是AI厂商提供的订阅服务。 ## 柒|那怎么办 我不是反AI。我自己每天都在用AI。我用它查数据、整理素材、检查逻辑。它是工具。好工具。 但工具就是工具。 你不能因为锤子好用,就声称锤子敲出来的桌子是锤子的作品。 你不能因为AI能生成代码,就声称那段代码有版权,然后把它「开源」。 **我的观点很明确:凡AI参与生产的作品,不能有版权,也不能有开源。** 因为AI的训练数据是全人类的知识。全人类的知识不属于任何个人和公司。你拿全人类的知识训练出来的东西,不能声称是你的,然后选择「开源」还是「闭源」。 这就像你不能从公共水库取水,装瓶,然后声称你在「开源」这瓶水。 有人说,那AI辅助写作怎么办?人类用AI做工具,产出的东西完全不能保护吗? 我再说一遍:美国版权局已经给了答案。你用AI辅助,你自己的创造性贡献部分可以有版权。AI生成的那部分没有。你改了三个变量名,那三个变量名是你的。剩下的不是。 你说这不公平?确实不公平。但这个不公平的根源,不是版权法太严格,而是AI侵蚀了「创作」和「生成」之间的边界。当工具智能到让「使用工具」和「工具替你完成」变得难以区分的时候,你不能怪法律划不出一条清晰的线。 你得怪那个把线搅浑的人。 谁搅浑的?是谁在鼓吹「AI创作」?是谁在营销「人人都是创作者」?是谁在告诉你「你只要写一句话,剩下交给AI」? 是AI厂商。 他们一边把「创作」的门槛降到零,一边在法律上收割你零门槛产出的版权真空。你什么都没创造,你当然什么都不能拥有。但你不会意识到这一点,因为你沉浸在「我也能创作了」的幻觉里。 **幻觉是免费的。版权是收费的。** 小孩子随手画的画可以有版权。因为那只猫是她自己想的。歪歪扭扭,但属于她。 AI画的猫没有版权。因为那只猫是几百万个人类画师的作品的概率合成。它不属于那个写prompt的人,不属于AI,不属于AI公司。它属于公共领域。 它从一开始就在公共领域。 你不能开源一个已经在公共领域的东西。你只能承认它在公共领域。 而一旦你承认了,你就必须面对一个更深的矛盾:如果AI产出属于公共领域,那AI厂商凭什么对你收费?他们卖的是公共领域的东西。 这个问题,留给你想。 ps. 我知道这篇文章会得罪人。用AI写代码然后开源的人会不爽。卖AI课程的人会不爽。靠AI生成内容赚钱的人会不爽。但有些话不说,不是不存在。版权的边界,不是靠假装模糊就能解决的。要么面对它,要么被它反噬。 **Categories:** 开源模型 ---