Le 1er septembre, le département de la Justice américain a déposé une « déclaration d’intérêts des États-Unis » dans lequel il défend l’utilisation licite des archives du New York Times par OpenAI. Supprimer les « barrières au leadership américain en matière d’intelligence artificielle » permettrait de « soutenir et renforcer la domination mondiale des États-Unis en matière d’IA afin de favoriser l’épanouissement humain, la compétitivité économique et la sécurité nationale ». Autrement dit, l’administration américaine souhaiterait que les sociétés proposant des outils d’intelligence artificielle puissent se prévaloir du fair use pour entraîner leurs modèles, sans avoir plus à se préoccuper, ni d’avoir obtenu des autorisations d’exploitation de la part des titulaires de droits, ni d’avoir à leur verser de redevances en contrepartie de ces usages. Le fair use, qui constitue une exception au copyright, permet en effet de faire échapper au monopole des titulaires de droits certaines formes d’exploitation. Ainsi, selon l’objectif et la nature de l’usage (i), la nature de l’œuvre protégée (ii), la quantité et l’importance de la partie utilisée par rapport à l’ensemble de l’œuvre protégée (iii) et les incidences de l’usage sur le marché potentiel ou la valeur de l’œuvre protégée (iv), l’exploitation par un tiers pourra être jugée « loyale ». C’est ici ce que défend l’administration américaine.
Refuser à OpenAI le bénéfice du fair use dans le cadre de l’entraînement de ses modèles d’IA entrerait, selon le département de la Justice, en contradiction avec les principes fondamentaux du copyright et nuirait à la concurrence sur le marché des modèles d’IA. D’une part, parce que la loi sur le copyright a pour objectif premier de promouvoir le progrès de la science et des arts utiles et non pas de récompenser le travail des auteurs. D’autre part, parce que seules les grandes entreprises disposeraient du capital nécessaire pour conclure des licences avec les titulaires de droits. Dès lors, permettre aux entreprises américaines d’entraîner gratuitement leurs modèles d’IA sur des contenus protégés par un copyright participerait à la préservation des « intérêts souverains » de la nation américaine.
Au regard des différentes conditions nécessaires à la démonstration d’un usage loyal, le département de la Justice a, dans un premier temps, fait valoir que l’entraînement des LLM constituait un usage transformatif, conformément à ce que sous-tend la première condition légale de mise en œuvre du fair use et à l’interprétation qui en a été faite dans l’affaire Campbell v. Acuff Rose (Campbell v. Acuff Rose Music Inc., 510 U.S. 569, 1994). Cela suppose d’établir que l’utilisation de l’œuvre nouvelle poursuit un objectif distinct de celui poursuivi par l’auteur de l’œuvre utilisée, et que l’œuvre nouvelle exprime un message nouveau ou ait un sens nouveau par rapport à celui de l’œuvre utilisée. Cette condition serait en l’espèce remplie selon la requérante puisque le « modèle de langage (LLM) d’OpenAI utilise l’œuvre protégée par le droit d’auteur non pas pour reproduire le contenu expressif de celle-ci, mais dans le cadre d’un processus visant à apprendre et à exploiter les schémas statistiques présents dans les textes écrits, notamment le vocabulaire, la syntaxe et les connaissances ». En conséquence, l’utilisation d’œuvres textuelles pour entraîner un LLM, parce que « la finalité de la copie – construire un modèle intelligent et interactif – diffère par nature de celle de l’œuvre copiée – utiliser le langage pour divertir ou éduquer directement un public de lecteurs », doit être regardée comme étant « hautement transformative », ce qui induit que sa finalité commerciale devrait être sans incidence sur l’application du fair use.
Dans un second temps, le département de la Justice va confronter les utilisations faites par OpenAI à la quatrième condition de mise en œuvre du fair use et en conclure que l’entraînement des modèles d’intelligence artificielle en cause n’a pas d’incidences sur le marché potentiel ou la valeur des œuvres protégées. En effet, là encore sur le fondement de l’affaire Campbell v. Acuff Rose, l’administration américaine rappelle que pour que l’utilisation secondaire d’une œuvre affecte le marché, il faut qu’elle se substitue à cette dernière ; qu’elle nuise à sa commercialisation. Or, prétend la requérante, la question n’est ici pas de savoir si l’utilisation litigeuse pourrait causer une baisse des ventes, mais si elle constitue une « concurrence de substitution significative », ce qui, selon elle, ne pourrait résulter que de la reprise de la forme d’expression de l’auteur des œuvres protégées. En effet, dans la mesure où le copyright, comme le droit d’auteur, porte sur l’empreinte de la personnalité de l’auteur, pour apprécier le degré de substituabilité entre l’œuvre primaire et les contenus qui en sont tirés, le département de la Justice suggère de rechercher si l’utilisation litigieuse « pourrait constituer un substitut significatif à l’achat de l’œuvre de l’auteur ». S’agissant d’œuvres journalistiques, cet argument ne nous semble pas équitable ni pertinent en ce qu’il ignore la valeur de l’information, pourtant déterminante, au sein des œuvres de cette nature. Cela présente toutefois l’avantage pour la requérante d’aboutir à la conclusion selon laquelle « même les résultats des LLM qui entreraient en concurrence avec des articles écrits – sans reproduire ni ressembler de manière substantielle à des aspects protégés de ces articles – ne seraient pas substantiellement similaires à des œuvres protégées par le droit d’auteur, ni ne constitueraient des substituts de celles-ci au sens pertinent ». Elle ajoute que dès lors que « les résultats ne copient aucun élément protégé de l’œuvre originale, et encore moins des parties significatives, ils ne peuvent causer le préjudice commercial en question simplement parce qu’ils appartiennent au même genre ou à la même catégorie d’œuvres que l’original, étant donné qu’un genre est une idée ou une méthode d’expression non susceptible d’être protégée par le droit d’auteur ».
La position ici défendue par le département de la Justice est pourtant contraire à ce qui avait été proposé par la District Court de Californie dans un litige opposant des auteurs à la société Meta Platforms Inc. (Kadrey v. Meta Platforms, Inc., 788 F. Supp. 3d 1026, 1044, N.D. Cal. 2025). Dans cette affaire, les magistrats avaient supposé qu’un LLM capable de générer « des informations précises sur l’actualité pourrait nuire considérablement au marché de la presse écrite » car « certaines œuvres sont relativement fonctionnelles et dépendent généralement moins de la créativité de l’auteur. Lorsqu’ils choisissent un article d’actualité, les lecteurs recherchent un texte qui leur présente un événement actuel (ou passé) de manière claire, précise et concise ».
Par ailleurs, la requérante propose une analogie critiquable entre l’apprentissage humain et l’entraînement d’une IA. À ce titre, le département de la Justice prend l’exemple de l’auteur Joan Didion qui, adolescente, pour apprendre le procédé stylistique d’Hemingway, avait retranscrit à l’identique ses romans à l’aide de sa machine à écrire. Il en déduit que rejeter le bénéfice du fair use à OpenAI reviendrait à engager la responsabilité de Joan Didion envers Hemingway pour chaque texte publié, pour chaque phrase qu’elle aurait écrite. Comme le département de la Justice le constate lui-même judicieusement, « obliger quiconque à payer spécifiquement pour l’utilisation d’un livre (…) chaque fois qu’il s’en inspire par la suite pour écrire de nouvelles choses d’une manière nouvelle serait impensable ». Or, c’est bien parce que cette approche n’est ni viable, ni défendable, qu’elle n’a jamais été sous-tendue par le copyright ou le droit d’auteur.
Cela n’empêche pas le département de la Justice américain d’en conclure que l’entraînement des LLM est « conforme au progrès créatif qui est l’objectif constitutionnel du droit d’auteur lui-même » et qu’il devrait donc relever du fair use. Il ne reste désormais plus qu’à attendre l’issue de ce litige initié le 27 décembre 2023 avec la plainte déposée par le New York Times.