Codeberg, l'alternative à but non lucratif à GitHub qui héberge des projets libres et open source, n'hébergera plus les logiciels « vibe codés » générés par l'IA, pour des raisons juridiques et de sécurité

Codeberg a mis en place une politique interdisant les dépôts composés en grande partie de code généré par des outils d’IA. Ce changement fait suite aux préoccupations de la communauté concernant les projets dits « vibe codés », dans lesquels l’IA produit la majeure partie, voire la totalité, d’une application avec une contribution humaine directe limitée. La plateforme a invoqué un statut flou en matière de droits d’auteur et de licences, ainsi que le risque que des projets générés en grande partie par l’IA puissent contenir du code nuisible ou non sécurisé sans garanties adéquates.

"Free/Libre and Open Source Software" (FLOSS) ou "logiciels libres et open source" sont des logiciels disponibles sous une licence qui confère aux utilisateurs le droit d'utiliser, de partager, de modifier et de distribuer le logiciel – modifié ou non – à tout le monde, et qui fournit les moyens d'exercer ces droits à l'aide du code source du logiciel. Le terme « logiciels libres et open source » (FOSS) est un terme générique inclusif englobant à la fois les logiciels libres et les logiciels open source. Tous les logiciels libres et open source ont un code source accessible au public, mais tous les logiciels dont le code source est disponible ne sont pas nécessairement des logiciels libres et open source. Les logiciels libres et open source s’opposent aux logiciels propriétaires, qui sont soumis à des licences restrictives ou dont le code source n’est pas divulgué.

Codeberg est une association allemande à but non lucratif spécialisée dans les services de développement de logiciels open source. Codeberg propose un environnement de développement logiciel collaboratif en ligne avec Forgejo, l’hébergement de pages statiques avec Codeberg Pages, une plateforme web de traduction collaborative avec Weblate et des solutions CI/CD avec Woodpecker CI et Forgejo Actions. Le développement de Forgejo, un fork de Gitea, s’effectue également sur Codeberg.

Ceux qui sont plongés dans l’univers du développement de logiciels connaissent GitHub. Le service web permet de faire de la gestion et du développement collaboratif de logiciels et est considéré par plusieurs observateurs comme le numéro 1 dans sa filière. Mais face aux nombreux suspension de comptes, les développeurs sont en constante recherche d’alternatives. Codeberg qui rentre dans ce lot attise donc leur intérêt et suscite des comparaisons avec des services similaires. L'interface utilisateur de Codeberg est assez similaire à celle de GitHub. Codeberg propose un simple hébergement Git, en plus de ne s’ouvrir qu’aux projets logiciels open source ou libres.

Récemment, Codeberg a mis en place une politique interdisant les dépôts composés en grande partie de code généré par des outils d’IA. Ce changement fait suite aux préoccupations de la communauté concernant les projets dits « vibe codés », dans lesquels l’IA produit la majeure partie, voire la totalité, d’une application avec une contribution humaine directe limitée. La proposition a été adoptée avec 358 voix pour et 144 contre, soit environ 71 % de soutien.

Codeberg a désormais ajouté cette restriction à la section 7 de ses conditions d’utilisation, en citant spécifiquement des outils tels que Claude et OpenAI Codex. La plateforme a invoqué un statut flou en matière de droits d’auteur et de licences, ainsi que le risque que des projets générés en grande partie par l’IA puissent contenir du code nuisible ou non sécurisé sans garanties adéquates.

Les dépôts peuvent toujours contenir de petites quantités de code généré par l’IA, mais cette politique s’applique lorsque celui-ci constitue la majeure partie d’un projet. La révision, la modification ou la maintenance par des humains ne semblent pas constituer une exception. Codeberg n’a par ailleurs pas défini de seuil technique ni expliqué comment il comptait identifier et sanctionner les violations, contrairement à des plateformes telles que GitHub qui continuent à développer leurs outils de codage basés sur l’IA.

Cette annonce rappelle qu'en novembre 2025, le créateur du langage Zig a annoncé la migration du référentiel principal du langage de GitHub vers Codeberg. Il a notamment déclaré : « GitHub a joué un rôle clé dans le succès initial de Zig en matière de collecte de fonds et il représente encore aujourd'hui une part importante de nos revenus. Bien que GitHub Sponsors représente une part importante des revenus de la Zig Software Foundation, nous le considérons comme un handicap. Nous demandons humblement à nos lecteurs qui font actuellement des dons via GitHub Sponsors d'envisager de transférer leurs dons récurrents vers Every.org, qui est elle-même une organisation à but non lucratif. »


Voici l'annonce de Codeberg :

Protéger notre patrimoine commun FLOSS contre les LLM

L’assemblée générale annuelle de Codeberg e. V. est la réunion qui donne le pouvoir à nos membres actifs. Les propositions sont discutées en direct, puis soumises à un vote asynchrone.

Les grands modèles de langage (LLM) étant une technologie émergente mais controversée, il n’est pas surprenant que deux des votes aient porté sur la position de Codeberg à l’égard de cette technologie. La période de vote de 14 jours s’est terminée hier et les deux propositions ont été acceptées.

Le premier vote portait sur une déclaration concernant la position de Codeberg e. V. quant à l’utilisation de vos données pour entraîner des LLM.

Comme indiqué dans notre politique de confidentialité, « Nous ne voulons pas avoir besoin de vos données », et cela vaut également pour l’utilisation de nos données d’utilisateurs et de projets dans le cadre de l’utilisation ou de l’entraînement d’une « IA » générative : la forge Codeberg et ses services associés n’utilisent pas et n’utiliseront pas le code ou les données des projets et des utilisateurs pour entraîner des outils d’« intelligence artificielle » tels que les grands modèles linguistiques, dont le but est de créer des résultats calqués sur leurs données d’entraînement. En tant qu’association, nous estimons que ces technologies sont incompatibles avec la création et la maintenance responsables de logiciels libres et open source.

Le deuxième vote a été plus controversé, mais a également été adopté avec 358 voix pour contre 144 contre (et 14 abstentions), avec un taux de participation élevé d’environ 50 % des membres actifs. Il implique une modification de nos conditions d’utilisation visant à interdire les « projets vibe codés ». Nous partagerons nos réflexions sur l’impact concret à la fin de cet article.

Nous payons tous pour ces grands modèles de langage (LLM) « voraces »

Les grands modèles de langage (LLM) constituent une technologie très coûteuse, et ces coûts ne cessent d’augmenter à mesure que les entreprises qui les fournissent doivent commencer à rentabiliser leurs investissements. Ils ne sont pas seulement coûteux pour ceux qui utilisent et s’abonnent explicitement à ces services. Ces coûts ne se cachent pas uniquement dans les abonnements « normaux » au cloud et aux services, qui financent de manière croisée les « nouvelles fonctionnalités innovantes » que vous n’avez jamais demandées. Les LLM sont si coûteux que les entreprises externalisent ces coûts à grande échelle — au détriment de ceux qui ne les utilisent pas et de la société dans son ensemble. Hausse des prix du matériel, consommation d’énergie et dommages environnementaux : nous en faisons tous les frais !

Des serveurs mis à rude épreuve par un crawling absurde

Dans des articles précédents, nous avons déjà expliqué comment notre infrastructure chez Codeberg est régulièrement soumise à une charge importante due aux robots d’indexation de ces entreprises qui prévoient d’ingérer l’intégralité du code hébergé sur Codeberg pour entraîner leurs LLM.

Chez Codeberg, nous sommes ravis d’offrir un accès libre et gratuit au code. Il suffit de lancer « git clone » et d’en profiter.

Malheureusement, ces robots d’indexation tentent au contraire de lire chaque page de Codeberg, que cela ait un sens ou non. Cela inclut toutes les variantes de filtres de tickets, l’historique Git, ainsi que les fichiers proprement dits à n’importe quel moment de l’historique Git — même s’ils sont toujours identiques.

Ces accès inutiles génèrent des requêtes de base de données coûteuses qui nuisent à la qualité du service pour nous tous, exigent un travail considérable de la part de nos administrateurs système et nous obligent à consacrer du temps à la mise en place de mécanismes de défense au lieu de développer de nouvelles fonctionnalités intéressantes. Des mécanismes qui affectent également les utilisateurs légitimes, nouveaux comme existants, car nous sommes contraints d’imposer des limites, voire des blocages purs et simples, à leur flux de travail souhaité, ce qui leur offre une expérience moins agréable avec Codeberg.

L’équipe de développement qui n’en est pas une

Utiliser des LLM pour travailler sur votre code vous procure une montée d’adrénaline. Vous pouvez développer à un rythme effréné, créer des choses comme si vous disposiez d’une grande équipe. Sauf que vous n’en avez aucune. En réalité, vous êtes (souvent) seul, travaillant avec une machine statistique qui transforme l’énergie en code.

Il semble que de nombreux « codeurs passionnés » ne se rendent pas compte qu’ils ne disposent en réalité d’aucune communauté autour d’eux. Ils développent des projets comme s’ils en avaient une, et dépensent leurs ressources en conséquence. Nous voyons des projets présentant une forte activité de codage, des tests CI/CD intensifs, ainsi que des versions binaires fréquentes et volumineuses. Parfois, on a l’impression que le nombre de plateformes prises en charge dépasse celui des utilisateurs réels.

À nos yeux, il semble ridicule de voir des projets menés par un seul développeur et n’ayant pratiquement aucun utilisateur consommer autant, voire plus, de ressources que certains des plus grands projets communautaires sur Codeberg, qui fonctionnent de manière économe en matière de CI/CD et de ressources de stockage. Nous ne pensons pas qu’il soit raisonnable pour Codeberg d’investir l’argent précieux issu de nos dons dans l’hébergement de grands projets fantômes.

L’approvisionnement en matériel devient un véritable casse-tête

L’entraînement et le déploiement des grands modèles de langage (LLM) ont considérablement fait grimper le coût d’achat du matériel, en particulier pour les SSD et la mémoire. Pour vous donner un exemple : le type de disque que nous achetions 700 € il y a seulement quelques années coûte désormais 3 700 € — et est souvent en rupture de stock. En conséquence, l’hébergement de code sur Codeberg devient de plus en plus coûteux.

Bien que nous soyons propriétaires de notre matériel et que nous ne soyons donc pas directement touchés par la flambée des coûts de location « dans le cloud », cela signifie que le remplacement ou l’extension de notre parc matériel est désormais nettement plus coûteux qu’auparavant (et que ce qui serait nécessaire). Même si nous sommes peut-être en mesure de supporter ces prix gonflés, il s’agit d’argent que nous ne pouvons pas consacrer à d’autres fins pour améliorer notre service et faire avancer la mission de Codeberg.

Un fossé numérique qui se creuse

Ces hausses de prix entraînent également un fossé numérique qui se creuse : les petits opérateurs, voire les grands, sont menacés par la hausse des coûts, tandis que seules les plus grandes entreprises du cloud disposent de contrats fiables pour le matériel. L’augmentation des coûts des services tels que l’hébergement de sites web, le stockage ou la puissance de calcul peut constituer un défi pour de nombreuses petites ONG, coopératives locales, projets de recherche et autres utilisations d’outils numériques que nous considérions comme acquises jusqu’à récemment.

Non seulement l’exploitation des infrastructures numériques devient plus coûteuse, mais même les outils numériques les plus basiques, tels que les ordinateurs et les smartphones, sont touchés par la hausse des coûts, reléguant l’informatique personnelle au rang de luxe — alors que nous vivons désormais dans un monde où les outils numériques constituent une condition sine qua non pour participer à la vie en société. Les appareils dotés de faibles capacités de calcul et de stockage privent les utilisateurs de leur souveraineté et les entraînent dans le piège financier des fournisseurs de cloud qui vous revendent ces mêmes services.

Les infrastructures civiques, leurs utilisateurs et l’environnement en pâtissent

Les répercussions négatives sur les infrastructures ne s’arrêtent pas là, mais concernent également les infrastructures civiques les plus fondamentales : en raison des besoins en énergie et en eau inhérents aux centres de données construits spécifiquement pour l’entraînement des grands modèles de langage (LLM), de nombreuses collectivités subissent d’ores et déjà une hausse des coûts de consommation, tant pour l’électricité que pour l’eau potable. Et au-delà de cette hausse des coûts, les personnes vivant à proximité des centres de données sont directement touchées par l’augmentation de la pollution atmosphérique et sonore.

Pour pouvoir alimenter ces centres de données, les entreprises qui les exploitent mènent également un lobbying actif afin d’être exemptées des réglementations environnementales : à Francfort, les centres de données consomment d’ores et déjà 40 % de l’électricité locale, et la demande ne cesse d’augmenter. Pour répondre à cette demande, elles souhaitent recourir aux combustibles fossiles.

La collaboration en danger

Ce ne sont pas uniquement les infrastructures numériques et civiques qui sont impactées par l’utilisation des LLM. L’écosystème des logiciels libres, dont nous considérons Codeberg comme un élément important, est un phénomène social axé sur la collaboration. Travailler de cette manière n’est possible que grâce au partage libre et à l’apprentissage mutuel. Cela inclut même de très petits outils qui sont partagés et réutilisés, et autour desquels la collaboration peut s’amorcer. À l’inverse, en adoptant les LLM, les gens ont tendance à coder de zéro des logiciels à usage unique. Bien que cela conduise à une augmentation du code « partagé », il s’agit principalement de code qui non seulement n’a été « écrit » par personne, mais qui n’est pas non plus maintenu par qui que ce soit.

Perte de confiance mutuelle

L’utilisation généralisée des LLM dans le FLOSS devient au contraire une attaque multidimensionnelle contre la confiance entre les contributeurs et contre l’idée même de collaboration conviviale. Les responsables de maintenance sont soumis à une charge de travail accrue en raison des contributions (souvent bien intentionnées) générées par des LLM, qui ne nécessitent que peu d’effort de la part de leurs auteurs mais demandent un temps considérable à examiner. Parallèlement, il devient de plus en plus difficile de distinguer les projets maintenus par des développeurs expérimentés de ceux générés par des LLM sans supervision ni apport humain significatif. Dans le cas des projets sous licence copyleft, les LLM conduisent en outre à un « blanchiment de licence », où le code copyleft est dépouillé de ses exigences de réciprocité en étant « généré » à partir des données d’entraînement.

Nous observons une tendance croissante à la méfiance mutuelle, au point que des personnes qui déploient un réel effort pour analyser les problèmes ou partager leurs suggestions sont accusées d’avoir utilisé des LLM alors qu’elles ne l’ont pas fait. Dans le même temps, d’autres ordonnent à leurs LLM de dissimuler leurs traces et d’éviter activement les schémas courants, ce qui incite les autres à examiner plus attentivement les contributions et les communications à la recherche de signes de génération automatique.

Entrer dans un cercle vicieux

Conjuguées, ces forces rendent la collaboration non seulement plus difficile, mais aussi moins gratifiante : Les coûts de transaction liés à la collaboration augmentant, les contributeurs sont de moins en moins enclins à participer à la création de projets logiciels de haute qualité et de plus en plus enclins à « coder à l’instinct » un logiciel ponctuel, spécifique à un besoin particulier, qui n’évoluera pas au-delà. Nous entrons ainsi dans un cercle vicieux où la collaboration devient de moins en moins gratifiante, tandis que le nombre de logiciels à usage unique, non maintenus et ne bénéficiant d’aucune amélioration, ne cesse d’augmenter.

Même si cela part souvent d’une bonne intention, partager le résultat d’un prompt en le qualifiant de « logiciel libre » ne contribue pas à rendre le monde meilleur. Codeberg n’est pas et ne souhaite pas devenir un lieu où l’on dépose ce genre de logiciels générés à usage unique que personne d’autre ne consultera jamais. Nous sommes un espace où les gens peuvent collaborer et améliorer ensemble des logiciels. Dans ce contexte, les votes récents peuvent être compris comme une réaffirmation de ces principes : comme nous souhaitons mettre l’accent sur la collaboration humaine, nous ne soutiendrons ni ne participerons activement à la création de LLM et nous n’utiliserons pas nos ressources limitées pour stocker des logiciels à usage unique qui viendraient polluer notre patrimoine commun FLOSS.

Évolution de nos conditions d’utilisation

La modification de nos conditions d’utilisation envoie un signal fort concernant notre mission et les projets que nous souhaitons soutenir. Cela dit, vous n’assisterez pas à une suppression massive de contenu dans les jours à venir. Notre équipe de modération ne commencera pas par dresser une liste exhaustive des dépôts concernés à supprimer. Au lieu de cela, en nous appuyant sur des cas comme les exemples ci-dessous, nous commencerons à mettre en œuvre les nouvelles règles. Nous sommes des êtres humains à l’autre bout, qui avons à cœur les projets et les communautés de logiciels libres.

Nous reconnaissons que de nombreux développeurs ont commencé à adopter les LLM comme outil dans leurs flux de travail. Certains les utilisent de manière intensive et codent rarement à la main, d’autres ne leur confient que des tâches spécifiques. Nous comprenons que vous souhaitiez savoir comment ce changement affectera vos projets à l’avenir. Bien que nous ne puissions pas donner de réponse simple, nous allons partager quelques remarques qui devraient répondre à la plupart des préoccupations soulevées lors de la discussion.

Quelques lignes directrices préliminaires, mais informelles

Si votre travail correspond à ces cas de figure, il est peu probable que vous soyez affecté :

- Les projets disposant d’une communauté active qui s’intéresse au logiciel et en assure la maintenance
- Les projets ayant une histoire significative antérieure à l’apparition des LLM
- Les responsables de projet qui ont accepté, à leur insu ou volontairement, des contributions générées par des LLM provenant d’autres contributeurs, si votre projet n’implique pas par ailleurs une utilisation intensive des LLM

Nous ne consacrerons pas non plus beaucoup de temps ni de ressources à l’analyse automatique du contenu sur Codeberg. Ainsi, bien que les cas d’utilisation suivants soient déconseillés (à l’instar des dépôts privés), ils seront probablement tolérés dans la pratique :

- Les projets parallèles et les expérimentations consommant peu de ressources
- Les outils spécifiques et les scripts personnalisés qui auraient de toute façon peu de chances de trouver une communauté, même s’ils n’étaient pas générés par un LLM

Cependant, nous devons également être honnêtes concernant certains cas d’utilisation qui pourraient ne plus être les bienvenus sur Codeberg. Si vous vous reconnaissez dans cette liste, vous n’avez pas besoin de partir tout de suite, mais il existe peut-être d’autres endroits mieux adaptés à vos besoins :

- Les projets créés de manière autonome par des « agents » de LLM
- Les projets écrits et maintenus en recourant massivement aux LLM
- Les projets pour lesquels la quantité de ressources (par exemple, le stockage, le CI/CD) est nettement supérieure à ce que les personnes impliquées auraient pu créer manuellement
- Les projets étroitement liés à l’écosystème des LLM, par exemple les outils écrits par des LLM pour faciliter l’utilisation des LLM
- Les utilisateurs envoyant des contributions générées par des LLM en violation des politiques spécifiques du projet

Source : Annonce de Codeberg

Et vous ?

Pensez-vous que cette annonce est crédible ou pertinente ?
Quel est votre avis sur le sujet ?

Voir aussi :

Forgejo : une forge logicielle légère autohébergée conçue pour faciliter la gestion collaborative des projets de développement. Le projet est un fork de Gitea et met l'accent sur des performances optimales

GitHub Copilot abandonne l'illimité et bascule en facturation à l'usage le 1er juin après des années de subvention silencieuse, l'essor de l'IA agentique rend l'ancien modèle économique insoutenable

À qui appartient le code généré par Claude, Copilot ou Cursor ? Donner des instructions à une IA suffit-il pour en être l'auteur légal ?