开源世界上最古老、最有影响力的项目之一已经开始正式投票,决定如何处理大型语言模型的贡献。 Debian 开发者于 8 月 15 日进行了一般性决议投票,可能会禁止、限制或完全接受整个发行版中人工智能辅助的工作——这一决定受到其他正在解决同样问题的自由软件项目的密切关注。
据 Linuxiac 报道,投票将持续到 8 月 28 日,投票列出了 8 项竞争提案,外加一个“以上都不是”选项。只有 Debian 开发人员可以投票,使用项目的排名选择投票系统来排序他们的偏好。对于触及自由软件社区的最新人工智能发展,这次投票是一场持续了数月的辩论的高潮——并且以不同的形式持续了两年多。
一场酝酿多年的辩论
Debian 在人工智能生成代码方面的斗争并不新鲜。 2024 年 5 月,该项目驳回了建立人工智能贡献政策的早期努力,认为这个问题还为时过早。关于人工智能模型和 Debian 自由软件指南的一般决议于 2025 年 5 月在投票结束前被撤回。今年夏天,争论重新燃起,开发人员在七月的邮件列表上争论法学硕士协助的工作是否属于社会契约向用户承诺完全免费操作系统的项目。
现在这个问题终于进入投票阶段——答案的范围异常广泛。
禁令的理由
最初的提案将修改 Debian 社会契约本身,以禁止 LLM 辅助的贡献:禁止直接 Debian 工作(例如打包、软件、文档、翻译、网站或项目通信)使用生成式 AI。在人工智能帮助下完成的上游项目不会受到影响。
该提案所陈述的理由读起来就像是自由软件运动反对生成式人工智能的总结:模型输出的版权和许可状态不明确、对人工智能生成工作的可靠性的怀疑、给维护者带来额外的审查负担、大幅削减用于训练数据的自由软件资源,以及大型人工智能系统的巨大资源消耗。
在最严格的一端,另一项提案要求贡献者尽可能避免使用 LLM,要求所有 Debian 通信(错误报告、邮件列表消息、Salsa 讨论,甚至 Planet Debian 博客文章)只能由人类撰写,并通过项目的行为准则强制执行违规行为。
中间立场:允许它,但拥有它
在两极之间,有几项提案将允许人工智能辅助贡献,同时将责任直接归于提交贡献者。
一种选择显然是允许法学硕士部分或全部贡献,前提是贡献者验证其技术质量、安全性、许可和实用性,充分理解他们提交的内容,并披露重要的人工智能帮助。它还将禁止将私人或敏感的 Debian 信息发送给不受信任的外部 AI 服务。
类似的提案承认了对生成式 AI 的担忧,但认为禁令将无法执行且会适得其反,只要符合 Debian 自由软件指南、经过贡献者的正确审查和理解,并在必要时标记为 AI 辅助,就接受 AI 辅助的工作。
最不干涉的选项是,Debian 既不支持也不禁止生成式 AI 工具,而是对每项贡献应用相同的质量、正确性、可维护性和合法性标准,无论它是如何做出的。贡献者仍然必须审查、理解、测试人工智能辅助工作并承担全部责任,鼓励但不要求披露。
一个更温和的变体将鼓励贡献者更喜欢人类作者和理解,而不在整个项目范围内实施禁令,保持自愿披露。
“Debian 是人类创造的”
最受讨论的选项之一是一个提案,其标题很简单,“Debian 是由人类创建的”。它不是监管贡献者使用什么工具,而是关注进入项目的内容:贡献者可以使用生成式 AI 进行研究、分析、探索或批评,但不能直接将 AI 生成的输出作为 Debian 打包、补丁、文档、错误报告、项目通信或其他官方工作提交。标题中体现了这一理念——是人类,而不是模型,创造了 Debian。
第八个也是最后一个提案采用了完全不同的视角,重点关注大规模人工智能系统对环境的影响以及 Debian 对此应该采取的应对措施。
为什么 Linux 发行版的投票很重要
Debian 不仅仅是一种发行版。它是包括 Ubuntu 在内的数十种衍生产品的基础,而 Ubuntu 又支撑着从云基础设施到全球基于 Linux 的开发人员工具的一切。 Debian 开发者采用的政策往往会向外扩散——影响到衍生发行版、打包实践以及更广泛的自由软件开发规范。
这次投票也是每个软件组织现在面临的一个问题的测试用例:当代码、文档和错误报告都可以由模型生成时,贡献意味着什么?一些项目已经收紧了围绕人工智能生成内容的贡献政策,而另一些项目则全面接受了它。 Debian 的排名选择投票——提供了八个不同的答案——是迄今为止任何主要开源项目所产生的困境的最细致的表达。
无论 8 月 28 日出现哪种选择,结果都将开创先例:要么是第一个正式限制 LLM 辅助工作的主要发行版,要么是一个措辞谨慎的框架,说明互联网基础软件社区之一如何决定与根据自己的输出进行训练的机器共存。
保持人工智能领先地位 阅读更多人工智能新闻 →