- Aunque el título apunta al tema de la inclusión de artistas en los datos de entrenamiento de Midjourney, el cuerpo incluido en la entrada se parece más a reacciones breves de lectores que a detalles de la controversia
- Un lector cuenta que había guardado Feeling Hard Or Hardly Feeling en su disco duro desde 2005-07-17 sin saber quién lo había creado
- Después de buscar tardíamente a su autor, dejó la frase “It means something”, lo que sugiere que la obra había permanecido con un significado personal durante mucho tiempo
- Otra reacción destaca la generosidad del creador, su enojo justificado y el agradecimiento por el arte, y considera que esa obra resume bellamente las dos primeras cosas
- Solo con el texto proporcionado no es posible confirmar información concreta como los criterios de la lista de entrenamiento de Midjourney, el alcance de las obras usadas o las medidas de respuesta
Una obra guardada durante mucho tiempo y un descubrimiento tardío
- Un lector había guardado Feeling Hard Or Hardly Feeling en su disco duro desde 2005-07-17
- En el momento de guardarla no sabía quién había hecho la obra, y solo mucho tiempo después buscó a su creador
- Con la frase “It means something”, deja ver que la obra conservó un significado personal para él
El alcance de las reacciones que se pueden confirmar en el texto
- Las reacciones breves incluyen generosidad del creador, enojo justificado y agradecimiento por el arte
- También se incluye la valoración de que esa obra resume bellamente las dos primeras cosas
- En el texto proporcionado no se confirman detalles como la lista de obras usadas en el entrenamiento de Midjourney, la forma en que se registró a los artistas ni los aspectos legales o técnicos
1 comentarios
Comentarios de Hacker News
Para mí, este es el punto clave. Aunque OpenAI no fuera una empresa con fines de lucro, claramente es una empresa valiosa, y ese valor proviene de tomar contenido creado por otras personas sin devolverles valor a ellas
Más allá de lo legal, me parece que eso está mal. Si se eliminara de todo el entrenamiento de OpenAI el contenido con copyright y sin autorización, ¿cuánto valor le quedaría al producto? Si crees que OpenAI vale menos sin poder usar contenido con copyright, entonces parte de ese valor debería volver al lado del contenido
Si no quieres que nadie vea, consuma o reciba influencia de tu obra, entonces deberías guardarla en una caja y no mostrársela a nadie. Siento cierta simpatía por los artistas que gritan que la IA crea imágenes demasiado parecidas a sus obras, pero cada vez menos. Puede que el resultado de verdad se vea muy parecido, pero si comparas esa obra con millones de otras, probablemente puedas encontrar algo similar entre obras humanas que ya existen
Por eso la ropa no está protegida por copyright. Por más original que creas que es, alguien ya hizo algo parecido en miles de años de historia de la moda. El arte visual podría estar acercándose a un punto similar. Por más original que creas que es tu pintura, en algún lugar ya existe algo parecido, y la IA tampoco está copiando imágenes de forma literal. Así como esta realidad no mató a la industria de la moda, tampoco va a matar al arte visual
En su sitio web dice lo siguiente: “Se está creando una nueva subsidiaria con fines de lucro para captar capital mediante la emisión de participaciones y contratar talento de clase mundial, mientras sigue bajo la dirección de la organización sin fines de lucro. Los empleados que antes trabajaban en el negocio con fines de lucro fueron transferidos a la nueva subsidiaria.”
https://openai.com/our-structure
Mientras nadie la copie tal cual, no creo que haya sido perjudicado porque se use con otro fin. Si otro artista la ve y se inspira, está bien; si una IA la ve y se inspira, me parece igual de inofensivo
Entonces, ¿los motores de búsqueda tendrían que pagarme regalías? A la escala de Google, eso parece impracticable. ¿Habría que declarar ilegales a los motores de búsqueda? Eso también tendría malos resultados. Me parece bueno que existan los motores de búsqueda
Por eso no me convence este argumento. Si lo llevas hasta sus últimas consecuencias de manera natural, obliga a llegar a la misma conclusión con otros proyectos también
Otro webcómic sobre el mismo tema: https://www.penny-arcade.com/comic/2024/01/03/terminarter
Si el sistema operativo te ocultó la barra de desplazamiento y no te diste cuenta de que la página seguía más abajo, también deberías leer la explicación en texto debajo del cómic
Realmente suena muy acertado
Más que ser difícil refutar este texto o lo que dice Penny Arcade, cuesta entender la tesis concreta entre tanta retórica. También parecería delicado discutir este tema en sus comentarios o en sus canales sociales
Entonces, ¿bajo qué condiciones podría aceptarse el arte de IA? Por ejemplo, ¿de verdad importa tanto si un gran corporativo creó este tipo de modelo? Si lo hubiera hecho una sola persona, no sé qué cambiaría en lo legal o en lo ético
¿Lo importante es si las obras de esos artistas estaban dentro de los datos de entrenamiento? ¿Y si un nuevo modelo, entrenado solo con fotos, videos y obras de arte de dominio público, fuera igual de potente? ¿Y si los modelos del futuro pudieran imitar un estilo con solo ver una o dos obras? Puede que sea cuestión de tiempo para que aparezcan modelos así. ¿En ese momento estaría bien? Si no, ¿por qué?
Personalmente, creo que así como la persona que crea una imagen con IA es quien la hizo, también el usuario del modelo de IA tiene la responsabilidad de usarla de manera legal y ética
Puede existir esa posibilidad o no. Pero si la IA actual se parece a un promedio complejo pero medio literal de las obras que varias grandes empresas pudieron raspar, entonces la reacción en contra parece perfectamente válida
Incluso hoy, mostrarle imágenes a un artista y decirle “quiero algo con esta vibra, pero con estas partes distintas” entra dentro del uso legítimo. También puedes pedirle a un guionista que vea Star Wars y escriba algo parecido
La cuestión del copyright no depende de si una obra protegida se usó como inspiración, sino de si el resultado es lo bastante transformador (
transformative)Para quienes obtienen ganancias de modelos entrenados con contenido exclusivo de creadores, empezar a pagar pronto el costo del contenido sería bueno para los creadores, para la sociedad e incluso para las propias empresas de IA.
Discutir si la ley de derechos de autor aplica o no a las empresas de IA es una distracción. Sí aplica. Solo hace falta ordenar un modelo de licencias adecuado.
También dijo que, si se pagara por todo el material con derechos de autor ya usado en los grandes modelos de lenguaje, las empresas que los crearon tendrían que pagar cada año regalías de “decenas a cientos de miles de millones de dólares”.
https://www.businessinsider.com/marc-andreessen-horowitz-ai-...
La ley de derechos de autor solo protege expresiones fijadas en un medio tangible, no ideas, conceptos o principios, y además existe el gran agujero del uso justo, así que el argumento legal no es sencillo.
Los creadores recibirán migajas, todos tendrán que pasar por APIs propietarias, y el open source podría volverse ilegal. No es un futuro que quiera ver.
Si entrenas un modelo con el arte de otras personas sin permiso y luego distribuyes gratis el modelo o sus salidas, incluso si no ganas nada de dinero, igual estás robando su trabajo.
Si la licencia del artista estaba limitada al uso no comercial, entonces usarla para entrenamiento comercial de IA ¿no sería una violación clarísima? De verdad quisiera saber por qué no.
Es la primera vez que leo algo sobre este tema que realmente me pega en lo emocional, así que aplaudo al autor.
La IA generativa que hoy está cambiando el mundo se construyó sobre el trabajo de tres grupos: desarrolladores de software, autores de comentarios en Reddit y artistas digitales. Quienes comentaban en Reddit renunciaron a sus derechos hace mucho y no les importa. Quedan los desarrolladores de software y los artistas digitales.
En general, los desarrolladores de software fueron bien recompensados, y los artistas digitales no. Los desarrolladores publicaron su trabajo de forma que pudiera modificarse; los artistas no. Tal vez la diferencia más importante es que los desarrolladores de software crearon la IA generativa. En cierto sentido, es nuestra propia creación, y se siente muy distinto que tu profesión sea devorada por algo que tú mismo hiciste a que lo haga un grupo externo y extraño.
Si Washington tiene que arder, mejor que la incendien los británicos y no los marcianos. ¿Cómo habríamos reaccionado si esto no fuera algo provocado por nuestras propias manos?
Si uno estuviera en esta situación, creo que sería muy difícil superar esa sensación horrible.
Para quien no es técnico, la tecnología parece indescifrable; para la gente común, la ley parece indescifrable; y la ética parece indescifrable para todos.
Cuando hay tanta confusión, puede ser difícil sentir que te trataron con justicia solo por unirte a una demanda colectiva para resolver cosas del pasado. Por ejemplo, un protocolo o sitio que conecte a quienes quieren demandar a una empresa ayudaría a la confianza pública. Hace falta algo que muestre que la sociedad respalda los valores de igualdad y justicia.
De verdad es así de simple.
Hay una solución sencilla.
Prohibir los modelos grandes cerrados entrenados con datos públicos, y exigir que esos modelos tengan pesos abiertos. Si una empresa quiere entrenar un gran modelo cerrado, que lo haga con sus propios datos.
Pero que una empresa pueda ser dueña de esos modelos sí parece injusto. No son producto del trabajo de la empresa, sino una expresión codificada de la producción cultural de toda la humanidad. Deberían pertenecernos a todos.
El problema aquí es que el modelo genera tal cual obras protegidas por derechos de autor. Quienes afirman que entrenar con obras con copyright ya es por sí mismo una infracción no tienen una base legal sólida. Solo difuminan a propósito los conceptos para que lo parezca, y cualquier juez competente lo vería de inmediato.
Si lo comparas con software, existe la licencia MIT, que permite uso comercial y cerrado de código fuente publicado. Para la dirección que imaginas, una licencia copyleft podría estar más cerca.
Antes de que existiera la cámara, y probablemente todavía en algunos casos, varios pintores operaban empresas que se dedicaban principalmente a copiar y vender obras de artistas famosos. Era una forma de poder colgar en casa una gran reproducción de una pintura famosa.
Se podría pensar que herramientas como Midjourney entran en la misma categoría, pero hay una diferencia clave. Hasta ahora, los sistemas de reproducción giraban en gran medida en torno a artistas exitosos y famosos. Para ganar dinero, había que reproducir algo que ya tuviera mucho valor para la gente, y además era muy claro que se trataba de una reproducción.
Ahora es distinto. Se está usando una enorme cantidad de trabajo, en parte reproducido, de artistas casi desconocidos, y de una manera en la que su origen se vuelve más difuso. Es válido que estos artistas sientan que les han robado. Están soportando un trato a lo Van Gogh sin la riqueza de la fama ni el consuelo de la reputación póstuma.
No conozco muy bien Cat and Girl, así que estuve viendo algunas entregas al azar y encontré esta historieta: https://catandgirl.com/heroes-and-villains/
A veces siento que el universo tiene un sentido del humor oscuro