开源平台Codeberg宣布:禁止用户数据训练AI,并封杀“氛围编程”项目

据知名开源代码托管平台 Codeberg 官方博客于7月23日发布的消息,该组织正式通过了两项关键决议,旨在保护开源社区资源并规范项目托管行为。首先,Codeberg 明确承诺绝不使用其平台上的用户数据来训练大语言模型(LLM)或其他人工智能工具,此举旨在捍卫自由及开源软件(FLOSS)的数据主权,防止用户代码被 AI 巨头无偿吞噬。其次,平台发起了一项针对“基于氛围编码”(Vibe Coding)项目的治理行动,并在最终投票中以 358 票赞成、144 票反对和 14 票弃权的结果获得通过。Codeberg 指出,许多所谓的“氛围程序员”在没有实际用户社区支持的情况下,臆想项目规模,盲目投入大量资源。这些项目往往表现出极高的代码活跃度,启用繁重的 CI/CD 测试流程,频繁发布体积庞大的二进制文件,甚至支持的平台数量超过了实际用户数。这种“虚假繁荣”导致了严重的资源浪费,部分单人项目的资源消耗量甚至超过了 Codeberg 上最大的社区项目。为了维护公平性,Codeberg 决定限制此类低效能项目,确保有限的计算和存储资源服务于真正具有社区价值的应用。

事件分析

Codeberg 此举标志着开源社区在面对 AI 浪潮和资源通胀时的主动防御,具有显著的行业风向标意义。在数据层面,拒绝 LLM 抓取是对当前科技巨头“剥削”开源数据的一种反叛,强调了代码托管平台作为“数字公地”的守护者角色,可能促使其他平台如 GitHub 重新审视其数据训练政策。在技术治理层面,对“Vibe Coding”的打击揭示了一个被忽视的现象:DevOps 工具的便利性掩盖了资源使用的低效。过度依赖自动化流水线、盲目追求多平台适配而忽视实际用户需求,是一种技术上的“伪勤奋”。这一决议不仅是对基础设施成本的优化,更是在倡导一种回归本质、注重实际效能的工程文化,迫使开发者在追求技术指标的同时,必须考量投入产出比。

💡 核心观点:拒绝AI吞噬与资源浪费,Codeberg正通过“数据洁癖”与“反伪勤奋”重塑开源社区的务实主义价值观。

原文链接:Linux.do

C code80.ai · AI 编码 API 聚合 Claude / GPT 多模型统一接入,稳定不限速,按量计费,几行配置接入 Claude Code。 了解一下 ›

抢沙发

评论前必须登录!

立即登录   注册