100. Multitudes 100. Automne 2025
Articles 100.
Les numéros

ProprIAté intellectuelle
Regarder vers l’aval plutôt que l’amont

Partagez —> /

Les questions relatives à l’autorialité et à la propriété des œuvres créées par l’IA peuvent être divisées en deux grandes catégories. La première concerne les vastes quantités de documents rédigés par des humains qui sont intégrés dans les modèles d’IA dans le cadre de leur « entraînement ». La seconde concerne la propriété des œuvres produites par les IA. Appelons respectivement ces deux catégories les problèmes d’input et d’output1.

Le problème de l’amont (input)

Jusqu’à présent, l’attention – et les poursuites judiciaires – se sont concentrées sur le problème de l’input. Le modèle économique de base des LLM (Large Language Model) repose sur l’appropriation massive de textes écrits par des humains, et il n’y en a tout simplement pas assez dans le domaine public. Ces textes proviennent en grande partie de bases de données constituées par des « crawls », qui parcourent internet à la recherche de textes provenant de sites d’information, de forums et d’autres sources. Conscients que cet écumage de données (scraping) à grande échelle n’a pas été « testé juridiquement » – c’est le moins qu’on puisse dire – les développeurs ont quand même foncé, se résignant à régler la question devant les tribunaux après coup.

L’enjeu est énorme : la propriété intellectuelle représente environ 90 % de la croissance économique récente des États-Unis. À l’heure où nous écrivons ces lignes, les entreprises d’IA ont largement répondu aux poursuites judiciaires par une attitude défensive et évasive, refusant dans la plupart des cas de divulguer les corpus de textes exacts sur lesquels leurs modèles ont été « pré-entraînés ». Au cœur de ces litiges, la question de l’input se pose donc dans ces termes : est-il juste d’entraîner les LLM sur tous ces textes protégés par le droit d’auteur sans rémunérer les humains qui les ont produits ?

Votre opinion sur le problème de l’input dépendra sans doute de votre vision de la véritable nature des LLM2. Les détracteurs de l’IA générative ont tendance à considérer sa manière de répondre aux questions comme un simple copier-coller élaboré à partir de documents écrits par des humains, incapable de montrer une véritable compréhension de ce qu’il dit, sans parler d’un vrai travail de digestion de ce qu’il lit. Ce point de vue est clairement exprimé dans la caractérisation désormais célèbre des LLM comme des « perroquets stochastiques ». Selon cette vision, les résultats ne sont que des remixes illégaux d’œuvres protégées par le droit d’auteur. Ceux qui attribuent davantage d’autonomie à la technologie, en revanche, comparent son métabolisme de lecture des ensembles d’entraînement à la créativité humaine qui, tout en s’appuyant sur les œuvres créatives que nous avons déjà expérimentées, peut aussi s’en éloigner.

Malgré toute l’attention accordée aux questions d’input, il est possible que ce problème s’avère le plus simple à résoudre des deux. Séduits par les sirènes des développeurs d’IA qui promettent une croissance économique rapide ou un avantage géopolitique, plusieurs juges ont déjà fait part de leur intention de rejeter les revendications des auteurs dont les œuvres ont été écumées par les crawls. À long terme, la meilleure façon de redistribuer une partie des bénéfices de l’IA aux auteurs pourrait être de légiférer sur un régime de licence obligatoire, obligeant les développeurs à garder une trace des œuvres sur lesquelles ils entraînent leurs modèles et à les rémunérer selon une formule inscrite dans la loi. Certains détenteurs de droits d’auteur pourraient finir par gagner beaucoup d’argent grâce à l’entraînement des IA – même si les grandes entreprises contrôlant d’énormes corpus de textes (comme les maisons d’édition et les journaux) seraient en meilleure position pour en bénéficier que les auteurs individuels. Mais en fin de compte, il est probable que les tribunaux et les gouvernements ouvriront la voie à l’existence de ces modèles sur une base juridique solide.

Le problème de l’aval (output)

Qu’en est-il alors des LLM eux-mêmes, ainsi que des médias et des idées qu’ils contribuent à générer ? Cela nous amène au problème de l’output. Lorsque la poussière des premiers débats sera retombée, qui détiendra les droits d’auteur d’un paragraphe produit par un chatbot ? À l’heure où j’écris ces lignes, personne ne le sait.

Il semble y avoir six possibilités. La première met en avant les développeurs de l’IA. Si les développeurs ont créé et sont propriétaires du LLM, et si le LLM a créé un paragraphe, alors les développeurs ne devraient-ils pas être propriétaires du paragraphe ?

C’est peut-être la situation juridique actuelle dans quelques juridictions. En vertu de la loi britannique du Copyright, Designs and Patents Act de 1988, dans le cas d’œuvres « générées par ordinateur dans des circonstances telles qu’il n’y a pas d’auteur humain », la paternité de l’œuvre est attribuée à « la personne qui a pris les dispositions nécessaires à la création de l’œuvre ». Mais la formulation étonnamment vague de la loi n’a jamais été testée devant les tribunaux. Qui sont précisément les personnes qui ont pris les « dispositions nécessaires à la création de l’œuvre » ? Les développeurs ? Qu’en est-il du prompteur, ou du client ou de l’employeur qui le rémunère ? Quoi qu’il en soit, attribuer la propriété aux développeurs remet certainement en question notre conception traditionnelle de l’autorialité d’une œuvre. GPT-4 produit régulièrement des phrases qu’aucun de ses codeurs n’a écrites, ni demandé d’écrire, ni même imaginées.

Une deuxième possibilité met en avant les différentes entreprises qui accordent des licences pour l’IA et jouent un rôle dans l’affinement de ses résultats (fine-tuning). Un élément qui pourrait renforcer leur revendication est le fait qu’un concédant de licence peut modifier considérablement le fonctionnement de l’IA, par exemple en utilisant ses propres données internes comme matériel pour l’affinement, ou en demandant à ses propres employés d’évaluer les réponses de l’IA aux prompts. Une expérience récente au Canada apporte de l’eau au moulin de la propriété du titulaire de la licence. Fin 2022, dans une affaire impliquant le chatbot d’Air Canada, qui avait fourni avec assurance des informations erronées sur une politique de réduction pour décès, un juge a estimé qu’Air Canada était légalement responsable du contenu généré par son IA. Historiquement, le revers de la responsabilité a souvent été la propriété. Comme l’a observé Michel Foucault, les noms des auteurs ont d’abord été imprimés sur les livres, non pas pour qu’ils puissent être reconnus et récompensés, mais pour qu’ils puissent être punis si le contenu du livre déplaisait aux autorités.

Une troisième possibilité – avancée par certains auteurs attaquant en justice les développeurs d’IA – est que la propriété des résultats appartient aux créateurs des données d’entraînement. Cette alternative pourrait être plus probable si les tribunaux suivaient certains scientifiques en adoptant une vision relativement minimaliste – celle du « perroquet stochastique » – de ce que l’IA générative est capable de faire.

Dans le cas des LLM actuels, cependant, il est impossible d’analyser la plupart des résultats typiques comme un remix d’un sous-ensemble particulier de données d’entraînement. Les milliards de paramètres internes d’un modèle sont le résultat collectif de son entraînement sur l’ensemble des données qui lui ont été fournies. Néanmoins, vous pourriez simplement insister sur le fait que les nombreux auteurs de l’ensemble d’entraînement d’un modèle – ou plus précisément tous ceux qui détiennent des droits d’auteur – sont en quelque sorte les coauteurs des résultats de la machine.

Quelle que soit votre intuition, cette affirmation sera très certainement rejetée par les tribunaux au nom de « l’utilisation transformative » (transformative use). La Cour suprême des États-Unis a défini la transformativité en fonction du degré selon lequel l’utilisation d’un matériel source « modifie l’original en lui donnant une nouvelle expression, une nouvelle signification ou un nouveau message ». Si votre utilisation d’une source est suffisamment transformative, elle est protégée par la doctrine du fair use (« usage équitable »).

La quatrième possibilité est que la propriété appartienne aux utilisateurs qui promptent, incitent, cajolent ou trompent carrément l’IA pour qu’elle produise un résultat spécifique. Il est certain que l’ingénierie des prompts est une compétence soigneusement perfectionnée, qui pourrait peut-être un jour être reconnue comme une véritable forme d’art ; un prompt précis, détaillé et novateur pourrait contenir suffisamment d’idées originales pour que l’utilisateur obtienne le droit d’auteur sur le résultat produit par l’IA. Suivre cette voie pourrait aboutir à une répartition démocratique et attrayante de la propriété parmi une vaste population de millions d’utilisateurs de ces systèmes, qui comprend de nombreuses personnes auxquelles on a refusé historiquement l’accès à l’autorialité légale.

Cinquième candidat à la propriété : personne, c’est-à-dire tout le monde. Le domaine public, décrit par Louis Brandeis comme « aussi libre que l’air pour l’usage commun », offre un espace crucial exempt de propriété qui favorise l’innovation. Reconnaissant qu’une propriété excessive peut étouffer la créativité, la loi crée le domaine public comme une zone de liberté sans entraves.

Les développeurs d’IA feront sans doute valoir qu’ils doivent pouvoir exploiter les produits de leurs modèles afin d’encourager l’innovation. Les détenteurs de licence revendiqueront d’être récompensés financièrement pour tous leurs efforts visant à affiner les modèles d’IA afin d’obtenir le type de résultats qu’ils recherchent. Les studios hollywoodiens demanderont : comment pouvons-nous utiliser l’IA pour générer de merveilleuses images appréciées par toutes les familles si Pierre et Paul peuvent « voler » les personnages, les intrigues et les graphismes qu’elle génère pour nous ? Comment pouvons-nous consacrer notre expertise à l’affinement des IA pour concevoir des médicaments plus performants, se plaindront les sociétés pharmaceutiques, si nous ne pouvons pas récupérer notre investissement en contrôlant le marché grâce à la protection de la propriété intellectuelle ? Ces industries sont extrêmement habiles à influencer les cadres juridiques dans lesquels elles opèrent ; leurs efforts pour renforcer et étendre leurs droits de propriété intellectuelle ont abouti à une série de victoires stupéfiantes et sans équivoque. Comment pouvons-nous espérer que le domaine public, qui n’a pas de poids financier, pas d’armée d’avocats, pas d’investisseurs et pas de lobbyistes, puisse rivaliser avec cela ?

Il existe enfin un sixième candidat à la propriété des résultats : l’IA elle-même. Que signifierait le fait que le système lui-même détienne les brevets et les droits d’auteur sur ses créations ? La législation actuelle dans la plupart des juridictions stipule, explicitement ou implicitement, que seuls les humains peuvent être auteurs ou détenteurs de propriété intellectuelle – et les IA actuelles échouent manifestement à un certain nombre de tests importants pour être considérées comme des agents juridiques. Entre autres choses, elles ne peuvent pas accumuler et dépenser de l’argent, elles ne peuvent pas posséder de biens, elles n’ont pas de citoyenneté, pas de domicile et pas de droits ou de devoirs civiques.

Voilà pour le problème de l’output, du moins lorsqu’on l’examine à l’aide des techniques familières du raisonnement juridique et philosophique. Mais ces questions ne relèvent pas uniquement de l’analyse intellectuelle. Elles sont profondément politiques et ont d’énormes conséquences en matière de distribution des richesses.

Les nouvelles luttes de la propriété intellectuelle à l’ère de l’IA

Dans son livre Four Futures (2016), Peter Frase imagine un monde dans lequel le progrès technologique a supprimé toutes les contraintes pesant sur la production économique. Mais le communisme de luxe entièrement automatisé n’est pas le seul horizon que peuvent prendre ces développements technologiques, prévient Frase. Le droit de propriété intellectuelle pourrait tout aussi bien servir de base pour maintenir les masses dans un état de pénurie artificielle, contraintes de payer un loyer aux propriétaires des technologies qui assurent leur subsistance.

Si nous voulons imposer une volonté sociale collective afin de garantir que les avantages économiques potentiels de l’IA soient largement partagés, nous ne pouvons pas nous permettre d’attendre que tout l’argent et le pouvoir reviennent à la Silicon Valley, avant de commencer à réfléchir ensemble à leur redistribution. Nous devons débattre dès maintenant de ces règles et travailler immédiatement à l’élaboration d’un nouveau cadre de propriété intellectuelle, en nous appuyant sur la dynamique créée par les décisions judiciaires. Pour ce faire, il faut effacer le vernis d’inévitabilité qui entoure notre héritage en matière de propriété intellectuelle, et reconnaître qu’en tant que sujets démocratiques, nous avons à la fois le pouvoir et la responsabilité de gérer les retombées économiques de la technologie d’une manière que nous jugeons juste.

Les contours d’un système de propriété intellectuelle juste à l’ère de l’IA sont déjà clairs. L’accélération drastique de la création de propriété intellectuelle rendue possible par l’IA devrait s’accompagner d’une réduction drastique de la durée des droits d’auteur pour les œuvres réalisées avec l’aide de l’IA. Les législateurs devraient envisager de légiférer pour confirmer que les éléments de propriété intellectuelle générés de manière autonome par l’IA appartiennent au domaine public, la charge de la preuve incombant aux créateurs humains qui demandent des droits d’auteur et des brevets afin de démontrer que leur propre contribution au produit final était suffisamment importante pour justifier une protection. Dans les années de litiges et de négociations à venir, il sera nécessaire de faire appel à des groupes d’intérêt public bien financés et juridiquement compétents pour défendre le bien commun, qui s’identifie souvent au domaine public.

Nous pourrions peut-être nous pencher sur une question encore plus fondamentale. Si l’on doit prendre au sérieux les annonces et les prétentions des développeurs d’IA en matière d’accumulation de capital, de puissance et de dangers, devrions-nous vraiment autoriser les entreprises privées à détenir des brevets sur cette technologie ? Si cette question paraît folle, ce n’est qu’un signe de la prégnance de l’idéologie néolibérale sur notre époque.

Dans le cas de l’IA, c’est une fois de plus le droit de la propriété intellectuelle qui érige le mur et verrouille la porte, pour assurer l’emprise des entreprises sur cette technologie. Or, ce qui a été créé par le droit peut être modifié par le droit. Telle est la réalité saisissante de la propriété intellectuelle, distincte même des formes physiques de propriété.

Indépendant de la physique, inapplicable par des agents de sécurité et des armées privées, le droit de la propriété intellectuelle est sereinement autonome par rapport aux réalités non humaines. C’est une création purement humaine et sociale. Ses règles et ses contours ne dessinent ni plus ni moins que la forme d’une volonté humaine collective3.

Nous ne trouverons et n’exercerons cette volonté que si nous nous souvenons que le droit existe pour le bien-être humain, et non pour faire respecter des droits supposément « naturels ». À l’aube de l’ère de l’intelligence artificielle, les citoyens doivent se demander : allons-nous laisser notre mode de vie être dominé par une alliance contre nature entre une technologie du futur et un concept de propriété-autorialité venu d’une conception ancestrale appartenant au passé ? Ou allons-nous exercer notre volonté collective pour garantir que la technologie soit conforme à nos propres conceptions d’une vie meilleure ?

Abrégé et traduit de l’anglais
par Yvan Feutry & Yves Citton

1Cette entrée résume certaines thèses défendues par l’auteur dans son article « To Whom Does the World Belong ? The battle over copyright in the age of ChatGPT » paru dans la Boston Review, December 10, 2024 (en ligne sur www.bostonreview.net/articles/to-whom-does-the-world-belong). Nous remercions la revue et l’auteur pour leur aimable autorisation d’en publier cette traduction abrégée. Les titres et les notes ont été ajoutés pas la rédaction.

2Ces questions ont été discutées dans les dossiers Cultivons nos intelligences artificielles (no 78, 2020), et Intelligences Artistiques Génératives (no 96, 2024) de Multitudes.

3Sur ces questions, voir les dossiers Propriété intellectuelle (no 5, 2001), Du commun au comme-un (no 45, 2011) et Propriétés/Communs (no 41, 2010) de Multitudes.