AI 与知识共享的毁灭
开源社会契约的崩塌
生成式人工智能正在打破软件版权保护与开放性之间长达40年的平衡。几十年来,互联网的“社会契约”——建立在共享软件、免费软件以及GPL和知识共享等copyleft许可证之上——使得创作者能够在分享作品的同时,保留对其使用和署名的某些权利。大型语言模型(LLM)现在正在无视这些许可证,消耗这些公共数据,实际上打破了促成现代云和互联网基础设施的协议。
AI如何将开放性转变为负担
分享知识曾被视为对社区的馈赠,但由于以下几种新兴风险,它正成为作者和开发者的负担:
- 许可证规避: LLM吸收受许可保护的代码和内容,通常输出衍生作品,却无视原始许可证或未能注明原始作者。这消除了创作者公开发布作品的动力。
- 安全漏洞: 尽管开源代码一直受到审查,但AI现在可以以前所未有的规模和速度发现公共代码中的漏洞,可能增加滥用的风险。
- 维护负担: 公共代码库正日益被AI生成的“垃圾”——来自缺乏经验的用户的质量低下的拉取请求和贡献——所淹没,这消耗了维护者的时间却没有增加价值。
- 失去控制: 当作品被吸收到庞大的模型中,原始贡献被掩盖并作为商品重新分发时,通过法院执行许可证的能力就会减弱。
反驳观点:AI作为终极开源工具
并非所有技术人员都将这种转变视为对公共资源的毁灭。一些人认为,AI实际上通过将创作商品化并降低入门门槛,实现了自由软件运动的最终目标:
- 逆向工程: AI可以逆向工程二进制文件和协议,实际上将闭源软件转变为“自由”软件,允许用户无论原始许可证如何都能理解并修改它。
- 加速问题解决: 一些开发者认为,AI的好处——例如帮助解决关键的全球问题(如医疗保健)——远远超过传统开源伦理的损失。
- 现有风险: 对“黑暗时代”观点的批评者指出,供应链风险和漏洞发现在LLM出现之前早已存在,而AI实际上可以帮助开发者管理确保软件安全所需的海量更新。
更广泛的社会和经济影响
AI训练与知识产权之间的紧张关系反映了关于思想所有权的更深层次冲突。一些人将无视版权视为一场“非暴力共产主义革命”,其中思想被剥夺所有权以促进集体效用。另一些人则将其视为企业圈地运动,前沿AI公司通过私有化数百万开源贡献者的集体劳动来巩固财富和权力。
“技术会一直存在,但技术本身并不是让我们规范被抛弃的原因。是这些公司的经营者将他们的愿景和利润置于世界上其他所有人之上。”
最终,争论的焦点在于“数字黑暗时代”是技术本身的结果,还是部署这些技术的公司的商业模式的结果。如果分享的动力被消除,互联网的未来可能会从协作的公共资源转变为由少数AI驱动的寡头垄断所拥有的围墙花园。
Sources
相关
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch