- Los miembros de Codeberg e. V. aprobaron tanto la política de no usar datos de usuarios ni de proyectos para entrenar LLM como una modificación de los términos de uso para limitar proyectos de “vibe coding”
- La segunda moción, la más debatida, fue aprobada con 358 votos a favor, 144 en contra, 14 abstenciones y una participación de alrededor del 50%; las nuevas reglas se concretarán caso por caso, sin eliminaciones masivas inmediatas
- Los crawlers de LLM recorren filtros de issues, historial de Git e incluso páginas de archivos duplicados, generando carga sobre la base de datos; además, el precio de los SSD subió de €700 a €3,700, lo que aumenta los costos de infraestructura y la carga operativa
- Los mantenedores enfrentan la carga de revisar contribuciones de baja calidad hechas con LLM, proyectos donde no queda claro si hubo supervisión humana, lavado de licencias de código copyleft y desconfianza sobre si algo fue generado por máquina
- Los proyectos con comunidades activas o con historial previo a los LLM casi no se verán afectados, pero los proyectos creados por agentes autónomos, que usan LLM en exceso o consumen muchos recursos de repositorio y CI/CD en relación con su cantidad de personas podrían dejar de ser bienvenidos
Política sobre LLM confirmada por votación de los miembros
- En la asamblea general anual de Codeberg e. V. se debatieron dos mociones relacionadas con LLM y luego se realizó una votación asincrónica de 14 días, en la que ambas fueron aprobadas
- Según la primera moción, Codeberg forge y sus servicios relacionados no usan, ni usarán en el futuro, código de proyectos ni datos de usuarios para el uso o entrenamiento de IA generativa y LLM
- Se considera que estas tecnologías, que producen salidas imitando sus entradas, son difíciles de compatibilizar con desarrollar y mantener software libre y de código abierto de manera responsable
- La segunda moción fue aprobada con 358 votos a favor, 144 en contra y 14 abstenciones, con la participación de cerca del 50% de los miembros activos
- Esta moción modifica los términos de uso para prohibir los “proyectos de vibe coding” y fue más polémica que la primera
Cómo los costos de los LLM se trasladan a Codeberg
-
Carga de servidor generada por crawling sin sentido
- Los crawlers web de empresas de LLM intentan leer todas las páginas web de Codeberg, en lugar de obtener el código público con
git clone - Entre los objetivos de acceso se incluyen:
- Varias combinaciones de filtros de issues
- Todo el historial de Git
- Las páginas de archivos reales en cada momento
- Archivos con el mismo contenido que en momentos anteriores
- Estos accesos disparan consultas costosas a la base de datos, degradan la calidad general del servicio y aumentan la carga de trabajo de los administradores de sistemas
- En vez de dedicar tiempo a nuevas funcionalidades, hay que construir mecanismos de defensa; además, los límites y bloqueos también afectan los flujos de trabajo de usuarios legítimos, nuevos y existentes
- Los crawlers web de empresas de LLM intentan leer todas las páginas web de Codeberg, en lugar de obtener el código público con
-
Grandes proyectos sin comunidad
- Con LLM, una sola persona puede desarrollar rápido como si fuera un equipo grande, pero solo trabaja con una máquina estadística que convierte energía en código: eso no crea una comunidad de desarrollo
- Algunos proyectos de desarrolladores individuales, aunque casi no tienen usuarios, incrementan la actividad de código, las pruebas de CI/CD y los binarios de lanzamiento grandes y frecuentes, y soportan más plataformas que usuarios reales
- Estos proyectos a veces consumen tantos recursos como los grandes proyectos comunitarios de Codeberg que operan CI/CD y repositorios con austeridad, o incluso más
- Codeberg considera que no es razonable usar donaciones para alojar proyectos fantasma a gran escala
-
Aumento de precios del hardware
- El entrenamiento y despliegue de LLM elevó considerablemente el costo de compra de SSD y memoria; el tipo de unidad que hace unos años se conseguía por €700 ahora subió hasta €3,700 y suele no haber stock
- Al contar con hardware propio, Codeberg evita el impacto directo del aumento de alquileres en la nube, pero el costo de reemplazar y ampliar equipos creció mucho
- Aunque se pueda comprar equipamiento más caro, eso reduce el presupuesto disponible para mejorar el servicio y cumplir la misión de Codeberg
- Esto también afecta los costos de alojamiento de código y los límites de almacenamiento
Brecha digital y carga sobre la infraestructura ciudadana
- Mientras suben los precios del hardware, solo las mayores empresas de nube pueden asegurar contratos de suministro estables, lo que amplía la brecha digital
- El aumento de los costos de hosting web, almacenamiento y cómputo recae sobre pequeñas ONG, cooperativas locales, proyectos de investigación y otros usuarios de herramientas digitales
- Los precios de computadoras y smartphones también pueden verse afectados, haciendo que la computación personal vuelva a ser un lujo, aunque hoy las herramientas digitales son prácticamente indispensables para participar en la sociedad
- Los dispositivos con poca capacidad de cómputo y almacenamiento debilitan la autonomía de los usuarios y los desplazan hacia la estructura de costos de proveedores de nube que les revenden las funciones faltantes
- Por la demanda de energía y agua de los data centers para entrenamiento de LLM, en algunas regiones aumentan los costos de electricidad y agua potable, mientras los vecinos quedan expuestos directamente a contaminación del aire y ruido
- Las empresas piden exenciones de regulaciones ambientales para abastecer de energía a los data centers; en Fráncfort, estos ya consumen el 40% de la electricidad local y la demanda sigue creciendo
- Se busca usar combustibles fósiles para satisfacer la demanda eléctrica creciente
Debilitamiento de la colaboración y la confianza en FLOSS
-
De software reutilizable a código desechable
- El ecosistema FLOSS es un fenómeno social en el que, mediante el intercambio libre y el aprendizaje mutuo, incluso las herramientas pequeñas se reutilizan y alrededor de ellas empieza la colaboración
- Al incorporar LLM, surge la tendencia a crear desde cero software desechable ajustado a necesidades puntuales, en lugar de mejorar juntos herramientas existentes
- Aunque aumente la cantidad de código compartido, crece también el código que no fue escrito directamente por personas y que nadie mantiene
-
Carga para mantenedores y lavado de licencias
- Incluso cuando se envían de buena fe, las contribuciones hechas con LLM y poco esfuerzo requieren mucho tiempo de revisión, aumentando la carga de los mantenedores
- Se vuelve difícil distinguir entre proyectos mantenidos por desarrolladores experimentados y proyectos creados con LLM sin una supervisión humana significativa
- En proyectos copyleft, ocurre lavado de licencias cuando se “genera” código a partir de datos de entrenamiento eliminando las obligaciones de reciprocidad
-
Desconfianza sobre si algo fue generado por máquina
- Aumentan los casos en que incluso personas que realmente analizaron un problema o redactaron una propuesta son sospechadas de haber usado LLM
- A la inversa, algunos usuarios instruyen a los LLM para ocultar rastros de generación y patrones comunes
- Quienes revisan contribuciones y comunicaciones deben buscar con más cuidado señales de generación automática, y la confianza entre integrantes se debilita
El círculo vicioso que generan los costos de colaboración
- Cuando suben los costos de transacción de la colaboración, baja la probabilidad de contribuir a proyectos de alta calidad y sube la probabilidad de hacer vibe coding de software desechable ajustado solo a necesidades personales
- Como resultado, se crea un círculo vicioso: disminuyen las recompensas de colaborar, mientras aumenta el software desechable que no se mantiene ni se mejora
- Compartir resultados de prompts y llamarlos “software libre” no basta para generar colaboración entre personas
- Codeberg aspira a ser un espacio donde las personas mejoran software en conjunto, no un lugar para tirar software generativo desechable que nadie volverá a mirar
- Por eso decidió no apoyar ni participar activamente en la creación de LLM, y no usar sus recursos limitados para almacenar software desechable que contamina los bienes comunes de FLOSS
Alcance de los nuevos términos de uso
- La modificación de los términos de uso aclara el tipo de proyectos que Codeberg busca apoyar, pero no implicará eliminaciones masivas de contenido en cuestión de días
- En lugar de generar automáticamente una lista completa de repositorios afectados para eliminarlos, el equipo operativo concretará las nuevas reglas a partir de casos reales
- El grado en que los desarrolladores usan LLM varía desde delegar casi toda la programación hasta delegar solo algunas tareas, por lo que no hay una única respuesta aplicable a todos los proyectos
- No se planea dedicar una cantidad considerable de tiempo y recursos a buscar contenido automáticamente
-
Proyectos con baja probabilidad de verse afectados
- Los siguientes tipos casi no se verán afectados:
- Proyectos con una comunidad activa que gestiona y mantiene el software
- Proyectos con un historial considerable anterior a la aparición de los LLM
- Casos en los que el proyecto en sí no usa LLM de forma excesiva, y el mantenedor aceptó contribuciones generadas con LLM por otros colaboradores, con o sin conocimiento de ello
- Los siguientes tipos casi no se verán afectados:
-
Proyectos que probablemente se permitan en la práctica
- Los siguientes tipos no se recomiendan, igual que los repositorios privados, pero al usar pocos recursos y no buscarse automáticamente, probablemente se permitan en la práctica:
- Proyectos secundarios y experimentos que usan muy pocos recursos
- Herramientas específicas y scripts personalizados en los que difícilmente surja una comunidad, independientemente de si fueron generados con LLM
- Los siguientes tipos no se recomiendan, igual que los repositorios privados, pero al usar pocos recursos y no buscarse automáticamente, probablemente se permitan en la práctica:
-
Proyectos que podrían dejar de ser bienvenidos
- Los siguientes tipos no necesitan migrar de inmediato, pero quizá encajen mejor en otros lugares de hosting que en Codeberg:
- Proyectos generados de forma autónoma por agentes LLM
- Proyectos escritos y mantenidos con uso excesivo de LLM
- Proyectos cuyo uso de recursos, como repositorios o CI/CD, sea marcadamente mayor de lo que el número de participantes podría producir a mano
- Proyectos fuertemente vinculados al ecosistema LLM, como herramientas escritas con LLM que facilitan el uso de LLM
- Usuarios que envían contribuciones con LLM violando las políticas de cada proyecto
- La redacción concreta puede consultarse en el commit de modificación de los términos de uso de Codeberg
- Los siguientes tipos no necesitan migrar de inmediato, pero quizá encajen mejor en otros lugares de hosting que en Codeberg:
1 comentarios
Opiniones en Lobste.rs
Soy extremadamente crítico de la IA, pero no sé cómo funcionaría esta política en la práctica. En efecto, la postura parece ser “prohibimos los resultados de baja calidad, pero sería absurdo vigilar todo uso de LLM”; sin reglas claras que se puedan hacer cumplir, es muy probable que termine aplicándose según gustos y preferencias.
Me preocupa que la entrada del blog y el texto que efectivamente se agregó a los términos de uso de Codeberg estén demasiado desconectados. El blog trata los costos sociales de los LLM y cómo perjudican la colaboración; en particular, resultaba convincente la parte sobre concentrar los recursos en la colaboración centrada en humanos, porque el software generado de un solo uso contamina los bienes comunes FLOSS.
Pero el enlace al cambio de términos del final prohíbe los proyectos cuyo código haya sido escrito mayoritariamente por IA generativa por el riesgo de derechos de autor poco claros y de código dañino. En el blog no aparecen en absoluto “copyright” ni “harm”, y en particular no es evidente por sí mismo que el código generado por LLM sea más dañino.
En el texto de los términos también hay errores gramaticales como “Such projects having”, guiones innecesarios e inconsistencias de nomenclatura entre “OpenAI Codex” y “Claude”. Como borrador está bien, pero que haya entrado en los términos después de una votación de más de 400 personas sin siquiera una corrección de estilo hace que la gobernanza de Codeberg genere inquietud.
Dicen que “las comunidades activas que valoran y mantienen el software” no se verán afectadas, pero es posible valorar el software aunque se desarrolle con ayuda de LLM.
MapLibre trasladó un proyecto a Codeberg, pero como su mantenedor usa mucho LLM en el desarrollo, tendrá que cerrar de nuevo el repositorio. Ghostty, un proyecto serio que busca irse de GitHub, ahora tampoco puede pasarse a Codeberg.
Como las reglas son ambiguas y las pautas del blog también son contradictorias, en la práctica se produce el efecto de prohibir todo uso de LLM. Cualquier comunidad open source que tolere aunque sea un poco el uso de LLM no asumirá el riesgo de ser expulsada de Codeberg.
Los operadores de Codeberg son personas reales, no sistemas automatizados contra abusos de las grandes tecnológicas. Lo más probable parece ser que primero inicien una conversación sobre que el proyecto quizá no encaja, y que ofrezcan un plan para migrar a otro lugar junto con un repositorio limitado en Codeberg para orientación.
No creo que todas las políticas deban, ni puedan, redactarse sin margen de interpretación. Actualmente mantengo en Codeberg un fork con una política de prohibición de uso de LLM, pero el código generado por el proyecto upstream antes del fork sigue ahí. Por ahora interpreto que está permitido, pero si no lo está respetaré la decisión y lo moveré a otro lado.
También es ambiguo si puede decirse que tzdata tiene una comunidad. Si alguien mantiene en solitario una utilidad que ayuda a compilar proyectos de otras comunidades y la hizo mayormente con vibe coding, tampoco queda claro si califica. Este tipo de criterio de selección se siente extraño y contrario al open source.
GitHub ya es un vertedero de resultados generados de baja calidad, así que no hace falta convertir a Codeberg en un segundo relleno sanitario.
Fui miembro pago de Codeberg durante dos años, pero ni siquiera sabía que se estaba llevando a cabo esta votación. En medio de un email de 1.800 palabras solo había una línea que decía “Declaración de Codeberg sobre el uso de IA”, y aunque se avisaba que habría una votación, no recibí ningún enlace para votar.
No queda claro si solo me lo omitieron a mí o si muchos miembros no recibieron la notificación de la votación.
Si quieres, puedes cambiarte a miembro activo en cualquier momento, y también puedes seguir posibles cambios revisando los pull requests de documentos de la organización en https://codeberg.org/Codeberg/org.
Codeberg declaró que también bloquea proyectos relacionados con criptomonedas y dejó claro que “Codeberg no es un espacio neutral, sino político”.
Mi trabajo principal está en el área de las criptomonedas, pero al elegir un servicio que sirva como respaldo de código y como identidad pública de un proyecto open source, quisiera evitar un lugar que mañana, según el clima político, pueda odiar mi área y eliminar mi respaldo y mi identidad. El papel de la infraestructura es mantener la neutralidad.
El entorno tecnológico actual, lleno de publicidad y hostil hacia los usuarios, también es resultado de que las organizaciones no declararan públicamente sus valores ni los defendieran. Que Google haya abandonado en silencio “don’t be evil” fue un símbolo culturalmente importante, aunque ya estuviera corrompida para entonces.
Los proyectos tienen derecho a definir las políticas que quieran, pero prohibir proyectos que crean código con LLM podría verse dentro de 20 años tan raro como prohibir el uso de lenguajes de alto nivel.
No se rechazaron los compiladores porque usaran más energía que los ensambladores, ni los compiladores optimizadores porque usaran todavía más, ni porque un lenguaje de alto nivel permitiera que una persona hiciera el trabajo de un equipo y creara una brecha digital entre quienes podían pagar el costo y quienes usaban lenguaje de máquina.
También hubo una época en que se creía que la gestión manual de memoria era mejor que un recolector de basura y que las verificaciones de límites eran demasiado lentas, pero habría sido impactante que SourceForge rechazara proyectos en Lisp o Haskell. Es raro ser tan negativo frente a una tecnología que aumenta enormemente las capacidades de programadores y usuarios.
Los compiladores no inflaron el precio del hardware de computación por una burbuja de inversión, ni recolectaron masivamente servicios de información sin permiso aumentando los costos operativos de organizaciones pequeñas e individuos. El complejo industrial de los LLM es cualitativamente distinto de los compiladores o lenguajes de alto nivel en todos los puntos críticos tratados por el blog, así que en vez de forzar una analogía, hay que responder al problema en sí.
Cuando empecé con computadoras a mediados de los 80, el único lenguaje gratuito era el BASIC que venía con la máquina, y los ensambladores, compiladores, linkers y aplicaciones eran todos de pago. Ahorré dinero para comprar mi primer ensamblador, también compré compiladores de C para MS-DOS y Amiga, y recién en los años 90 el código generado llegó a un nivel “apenas mejor que horrible”.
En los años 70 también había programadores que pedían mantener las verificaciones de límites, pero como la gerencia se obsesionó con los benchmarks, apenas ahora están aumentando los lenguajes que las ofrecen. Admito que los LLM ayudan a algunos usuarios de software con sus implementaciones, pero no aumentaron las capacidades de todos los programadores, y en mi caso no lo hicieron.
Todavía no he visto un repositorio útil compuesto solo por prompts, así que comparar compiladores y LLM ya es forzado solo por este punto.
Hay una reseña interesante de un usuario que migró recientemente a Codeberg: https://マリウス.com/i-regret-migrating-to-codeberg/
Es un sitio que, si activas JavaScript, recomienda de forma bastante agresiva no navegar por sitios arbitrarios en ese estado.
A medida que el mundo se convirtió en una aldea global, el alcance de las comunicaciones se amplió y todo el mundo civilizado se volvió psicológicamente parecido a una tribu primitiva; se siguen creando nuevas religiones y el secularismo está desapareciendo.
En un momento en que quienes estaban cansados de los movimientos autodestructivos de GitHub estaban adoptando ampliamente Codeberg para apoyar los bienes comunes digitales, me entristece mucho tener que abandonar Codeberg, como cuando Ghostty dejó GitHub.
El blog es relativamente razonable, pero el cambio en los términos es distinto, y aun así esos términos son mejores que el nombre de la propuesta, “prohibición de extrusiones de LLM”. Después de los productos generados por LLM vienen las criptomonedas, y no parece que esto vaya a detenerse aquí; podrían simplemente adoptar la frase de The JSON License: “el software debe usarse para el bien, no para el mal”.
Cada vez más proyectos FLOSS como Ghostty, Redis, rsync y el kernel de Linux usan herramientas de IA de forma responsable, y mantenerlos atados a GitHub es regresivo. Con este cambio no se gana nada y solo se pierde mucho avance en la libertad del software y los bienes comunes digitales.
Intentaba trasladar el proyecto Abject a Codeberg, pero ahora eso ya no será posible. Llevo 30 años programando y he mantenido varios proyectos open source; Abject usa mucho los LLM y también genera programas con agentes de codificación internos.
El objetivo es investigar el protocolo Ask y permitir que no solo programadores o ingenieros, sino también usuarios comunes, creen software para resolver sus problemas personales sin depender de SaaS ni de la buena voluntad de desarrolladores FLOSS. El movimiento del software libre consistía en abrir el código fuente para que los usuarios lo modificaran según sus propios fines, y Abject amplía aún más ese espíritu al permitir que los usuarios creen software directamente, sin necesitar un título en ciencias de la computación ni años de aprendizaje.
Entiendo que quieran impedir que los LLM entrenen con datos, pero si prohíben incluso alojar proyectos solo porque el código fue escrito con LLM, para mí, como defensor del software libre, Codeberg ya no tiene sentido. Codeberg parece estar más cerca del software open source que del software libre de FLOSS.