À propos du fait d’être mentionné comme artiste d’une œuvre utilisée pour l’entraînement de Midjourney
(catandgirl.com)- Le titre renvoie à la question de l’inscription d’artistes dans les données d’entraînement de Midjourney, mais le texte fourni ressemble davantage à de brèves réactions de lecteurs qu’à un exposé détaillé de la controverse
- Un lecteur explique qu’il conservait Feeling Hard Or Hardly Feeling sur son disque dur depuis le 2005-07-17 sans connaître son créateur
- Après avoir finalement recherché l’auteur, il a laissé le commentaire « It means something », montrant que l’œuvre était restée importante pour lui pendant longtemps
- Une autre réaction évoque la générosité du créateur, une colère légitime et de la gratitude envers l’art, estimant que cette œuvre résume magnifiquement les deux premières
- À partir du seul texte fourni, il est impossible de vérifier des informations concrètes comme les critères de la liste d’entraînement de Midjourney, l’étendue des œuvres utilisées ou d’éventuelles mesures prises
Une œuvre conservée longtemps et découverte tardivement
- Un lecteur gardait Feeling Hard Or Hardly Feeling sur son disque dur depuis le 2005-07-17
- Au moment de l’enregistrement, il ne savait pas qui en était l’auteur, et ce n’est que bien plus tard qu’il a cherché à l’identifier
- La phrase « It means something » montre que l’œuvre avait conservé une signification personnelle pour lui
L’étendue des réactions visibles dans le texte
- Ces brèves réactions expriment la générosité du créateur, une colère légitime et de la gratitude envers l’art
- Elles incluent aussi l’idée que cette œuvre résume magnifiquement les deux premières
- La liste des œuvres utilisées pour l’entraînement de Midjourney, la manière dont les artistes y sont mentionnés, ainsi que les détails juridiques ou techniques ne peuvent pas être confirmés à partir du texte fourni
1 commentaires
Commentaires sur Hacker News
Pour moi, c’est le point central. Même si OpenAI n’était pas une entreprise à but lucratif, c’est clairement une entreprise de valeur, et cette valeur vient du fait qu’elle a été construite à partir de contenus créés par d’autres sans leur reverser cette valeur
Quelle que soit la situation juridique, je pense que c’est mal. Si l’on retirait de l’entraînement d’OpenAI tout le contenu protégé par le droit d’auteur et non autorisé, combien de valeur resterait-il au produit ? Si vous pensez qu’OpenAI vaudrait moins sans contenu protégé, alors une partie de cette valeur devrait revenir aux créateurs de ce contenu
Si vous ne voulez pas que quiconque voie, consomme ou soit influencé par votre œuvre, il faut la mettre dans une boîte et ne la montrer à personne. J’ai une certaine sympathie pour les artistes qui dénoncent le fait que l’IA produise des images trop proches de leurs œuvres, mais elle diminue de plus en plus. Les sorties peuvent sembler vraiment proches, mais si on compare cette œuvre à des millions d’autres, on trouvera probablement déjà des œuvres humaines existantes qui lui ressemblent
C’est pour cela que les vêtements ne sont pas protégés par le droit d’auteur. Même si vous les trouvez très originaux, quelqu’un l’a déjà fait au cours des milliers d’années d’histoire de la mode. Il est possible que les arts visuels se rapprochent d’un point similaire. Même si vous pensez que votre peinture est très originale, il en existe déjà probablement quelque part une qui y ressemble, et l’IA ne copie pas littéralement les images. De même que cette réalité n’a pas tué l’industrie de la mode, elle ne tuera pas non plus les arts visuels
Leur site l’explique ainsi : « Une nouvelle filiale à but lucratif a été créée pour lever des capitaux via l’émission de parts et recruter des talents de classe mondiale, tout en restant dirigée par l’organisation à but non lucratif. Les employés qui géraient auparavant l’activité lucrative ont été transférés dans cette nouvelle filiale. »
https://openai.com/our-structure
Tant que personne ne la copie à l’identique, je ne pense pas subir un préjudice parce qu’elle a été utilisée à d’autres fins. Si un autre artiste la voit et s’en inspire, c’est acceptable, et je considère que c’est tout aussi inoffensif si une IA la voit et s’en inspire
Dans ce cas, les moteurs de recherche devraient-ils me verser des royalties ? À l’échelle de Google, cela semble impossible à mettre en œuvre. Faut-il simplement rendre Google illégal ? Ce serait aussi une mauvaise issue. Je pense qu’il est bon que les moteurs de recherche existent
C’est pourquoi je n’aime pas cette logique. Si on la pousse jusqu’au bout, elle force à tirer la même conclusion pour d’autres projets
Un autre webcomic sur le même sujet : https://www.penny-arcade.com/comic/2024/01/03/terminarter
Si le système d’exploitation a masqué la barre de défilement et que vous n’avez pas vu que la page continuait, il faut aussi lire le texte explicatif sous la BD
Ça sonne vraiment très juste
Plus que le fait qu’il soit difficile de réfuter ce texte ou la phrase de Penny Arcade, j’ai du mal à comprendre la thèse concrète au milieu de toute la rhétorique. J’aurais aussi l’impression qu’il faut être prudent en discutant de ce sujet dans leurs commentaires ou sur leurs réseaux sociaux
Alors, dans quelles conditions l’art généré par IA pourrait-il être acceptable ? Par exemple, est-ce vraiment important que ce modèle ait été créé par une grande entreprise ? Si un particulier avait créé le même modèle, je ne vois pas ce qui changerait sur le plan juridique ou éthique
Est-ce que l’important est que les œuvres de ces artistes figurent dans les données d’entraînement ? Et si un nouveau modèle, entraîné uniquement sur des photos, vidéos et œuvres d’art du domaine public, était tout aussi puissant ? Et si les modèles futurs pouvaient imiter un style après n’avoir vu qu’une ou deux œuvres ? Il est possible qu’un tel modèle n’apparaisse qu’une question de temps. Est-ce que ce serait acceptable à ce moment-là ? Sinon, pourquoi ?
Personnellement, je pense que, de la même manière que la personne qui crée une image avec l’IA l’a effectivement créée, c’est à l’utilisateur du modèle d’IA d’en faire un usage légal et éthique
Cette possibilité existe peut-être ou non. Mais si, à l’heure actuelle, l’IA ressemble à une moyenne complexe mais à moitié littérale des œuvres que plusieurs grandes entreprises ont pu aspirer, alors la réaction hostile paraît tout à fait légitime
Aujourd’hui déjà, montrer des images à un artiste et lui dire « je veux quelque chose dans cet esprit, mais différent sur tel point » relève du fair use. On peut aussi demander à un scénariste de regarder Star Wars et d’écrire quelque chose de similaire
La question du droit d’auteur ne dépend pas du fait qu’une œuvre protégée ait servi d’inspiration, mais du fait que le résultat soit suffisamment transformatif (transformative)
Il serait préférable pour les créateurs, pour la société, et même pour les entreprises d’IA, que ceux qui tirent profit de modèles entraînés sur du contenu exclusif de créateurs commencent rapidement à payer le coût du contenu.
Débattre de l’applicabilité ou non du droit d’auteur aux entreprises d’IA est une impasse. Il s’applique. Il suffit de mettre en place un vrai modèle de licence.
Ils ont aussi affirmé que si l’on payait pour tous les contenus protégés déjà utilisés dans les grands modèles de langage, les entreprises qui les ont créés devraient verser chaque année « des dizaines à des centaines de milliards de dollars » de royalties.
https://www.businessinsider.com/marc-andreessen-horowitz-ai-...
Le droit d’auteur ne protège que les expressions fixées sur un support, et non les idées, concepts ou principes, et il y a aussi l’énorme brèche du fair use, donc l’argumentation juridique n’a rien de simple.
Les créateurs recevraient des miettes, tout le monde devrait passer par des API propriétaires, et l’open source pourrait devenir illégal. Ce n’est pas un futur que j’ai envie de voir.
Si l’on entraîne un modèle sur l’art d’autrui sans autorisation, puis qu’on distribue gratuitement le modèle ou ses sorties, sans gagner le moindre centime, on vole quand même leur travail.
Si la licence de l’artiste était limitée à un usage non commercial, l’utiliser pour un entraînement d’IA commercial n’est-il pas une violation évidente ? J’aimerais vraiment savoir pourquoi ce ne serait pas le cas.
C’est le premier texte sur ce sujet qui m’ait fait ressentir quelque chose sur le plan émotionnel, donc bravo à l’auteur.
L’IA générative qui transforme le monde aujourd’hui repose sur le travail de trois groupes : les développeurs logiciels, les auteurs de commentaires sur Reddit, et les artistes numériques. Les auteurs de commentaires sur Reddit ont abandonné leurs droits depuis longtemps et cela leur est égal. Il reste donc les développeurs logiciels et les artistes numériques.
Dans l’ensemble, les développeurs logiciels ont été généreusement rémunérés, contrairement aux artistes numériques. Les développeurs ont publié leur travail de manière modifiable, ce que les artistes n’ont pas fait. La différence la plus importante est peut-être que ce sont les développeurs qui ont créé l’IA générative. D’une certaine manière, c’est notre propre création, et il y a une grande différence entre voir son métier dévoré par ce qu’on a soi-même construit et le voir dévoré par un groupe étranger venu de l’extérieur.
Si Washington doit brûler, il vaut mieux que ce soient les Britanniques qui l’incendient plutôt que des Martiens. Comment aurions-nous réagi si ce qui est arrivé n’avait pas été de notre propre fait ?
Dans une telle situation, il me semble très difficile de surmonter ce mauvais ressenti.
Pour les non-techniciens, la technologie paraît indéchiffrable ; pour le grand public, le droit paraît indéchiffrable ; et l’éthique paraît indéchiffrable pour tout le monde.
Quand la confusion est aussi grande, il peut être difficile de se sentir traité équitablement en se contentant de participer à une class action pour régler le passé. Par exemple, un protocole ou un site qui mettrait en relation les personnes souhaitant poursuivre des entreprises pourrait aider à restaurer la confiance publique. Il faut quelque chose qui montre que la société soutient les valeurs d’égalité et de justice.
C’est vraiment aussi simple que ça.
Il y a une solution simple.
Il faut interdire les grands modèles fermés entraînés sur des données publiques, et exiger que ces modèles aient des poids ouverts. Si une entreprise veut entraîner un grand modèle fermé, qu’elle le fasse sur ses propres données.
En revanche, le fait qu’une entreprise puisse posséder un tel modèle semble injuste. Ce n’est pas l’œuvre de l’entreprise, c’est en réalité une expression codifiée de la production culturelle de l’humanité tout entière. Nous devrions tous en être propriétaires.
Le problème ici, c’est que le modèle génère à l’identique des œuvres protégées. Ceux qui prétendent que le simple fait de s’entraîner sur des œuvres protégées constitue en soi une violation du droit d’auteur n’ont aucun fondement juridique. Ils entretiennent volontairement la confusion pour le faire croire, mais un juge compétent le verrait immédiatement.
Si l’on compare avec le logiciel, il existe des licences comme la MIT qui autorisent l’usage commercial et fermé de code source public. Dans la direction que vous imaginez, une licence copyleft serait peut-être plus proche.
Avant l’arrivée de la photographie, et sans doute encore aujourd’hui dans certains cas, plusieurs peintres faisaient tourner des entreprises qui vendaient principalement des copies d’œuvres d’artistes célèbres. L’idée était de pouvoir accrocher chez soi une belle reproduction d’un tableau connu.
On peut considérer que des outils comme Midjourney relèvent de la même catégorie, mais il existe une différence essentielle. Jusqu’ici, les systèmes de reproduction tournaient en grande partie autour d’artistes célèbres et reconnus. Pour gagner de l’argent, il fallait reproduire quelque chose auquel les gens accordaient déjà beaucoup de valeur, et il était aussi très clair qu’il s’agissait d’une copie.
Aujourd’hui, c’est différent. Une masse immense de travaux d’artistes presque inconnus est partiellement reproduite puis utilisée d’une manière qui en brouille davantage l’origine. Il est légitime que ces artistes aient le sentiment d’avoir été volés. Ils subissent un sort à la Van Gogh sans la richesse de la célébrité ni le réconfort d’une reconnaissance posthume.
Je ne connais pas très bien Cat and Girl, et en parcourant quelques épisodes au hasard, je suis tombé sur cette BD : https://catandgirl.com/heroes-and-villains/
Il m’arrive de penser que l’univers a un humour très noir