L’article ne peut pas être activé avec JavaScript. Vous pouvez également activer JavaScript dans votre navigateur et sur la nouvelle page.
Cinq agences de presse ont demandé à un juge fédéral de statuer qu’OpenAI et Microsoft ont enfreint la loi sur le droit d’auteur dans la manière dont ils ont construit et géré leurs produits d’IA. L’argument figure dans un mémoire de jugement sommaire de 92 pages déposé le 17 septembre devant le tribunal de district américain du district sud de New York, dossier 1:25-md-03143, et chaque mot de celui-ci représente le cas d’une partie. OpenAI et Microsoft contestent ces allégations, se défendent sur la base d’une utilisation équitable, et le tribunal ne s’est prononcé sur rien de tout cela.
Le mémoire s’ouvre sur les propres mots d’un dirigeant de Microsoft. Il cite Brent Hecht, directeur des sciences appliquées de l’entreprise, qui écrit que « des millions de personnes dans le monde considéreront bientôt que les grands mannequins « aspirent » tout leur travail comme un vol étonnant aux proportions sans précédent », et, séparément, qu’une victoire des entreprises « ridiculiserait complètement l’idée d’« utilisation équitable » ». Les deux lignes sont des sélections des demandeurs à partir de documents internes obtenus lors de l’enquête préalable, cités pour étayer leur propre requête.
Cinq éditeurs demandent une décision sur cinq types de copie
Les plaignants sont le New York Times, le groupe Daily News composé de huit journaux, dont le Chicago Tribune et le Denver Post, Ziff Davis, dont les marques incluent IGN, CNET, PCMag, ZDNET et Mashable, la salle de rédaction à but non lucratif derrière Mother Jones et Reveal, et The Intercept. Leurs cinq affaires ont été regroupées en une seule procédure multidistrict à New York et sont désormais plaidées ensemble.
La requête demande au tribunal de constater une contrefaçon sur cinq points : l’acquisition des articles, la formation de modèles sur ceux-ci, l’utilisation de l’index Bing de Microsoft pour ancrer les réponses en direct, la reproduction du texte dans les sorties Copilot et ce que le dossier appelle du « marchandage », les deux sociétés se transmettant des copies dans le cadre de leur partenariat. Les comptes de mise à la terre et de sortie pèsent uniquement sur Microsoft, ce qu’une note de bas de page explique en soulignant une motion de sanctions non résolue contre OpenAI. Le mémoire demande également une décision selon laquelle OpenAI a intentionnellement supprimé les informations sur la gestion des droits d’auteur des articles, et que les dommages-intérêts légaux devraient être comptés par article plutôt que globalement.
Le dossier s’appuie sur les propres personnes des entreprises
Nick Turley, responsable de ChatGPT chez OpenAI, a écrit que les éditeurs sont confrontés à une « menace existentielle » de la part de ces produits et qu’ils « sont largement substitutifs, point final », indique le mémoire. Il indique également que Satya Nadella a convenu sous serment que parler à un chatbot avait « remplacé » l’accès à la source sous-jacente.
Un document de Microsoft cité dans le dossier va plus loin, qualifiant la situation de « boucle catastrophique » dans laquelle « un produit final menace les fondements économiques de ses fournisseurs essentiels ». Il s’agit de citations choisies par les plaignants pour défendre leur cause, présentées sans les documents qui les entourent, et aucune d’entre elles n’a été évaluée par le tribunal.
Les chiffres de clics sont au cœur de l’argument du préjudice
Les propres données de Microsoft, telles que les présentent les notes, montrent des taux de clics en baisse de 87 à 93 % pour les sites du Times, de 83 à 91 % pour les sites du Daily News et de 51 à 94 % pour les sites de Ziff Davis lorsque l’on compare le moteur de réponse de Copilot à la recherche Bing traditionnelle. Le dossier ajoute une étude tierce révélant que 87,78 % des utilisateurs de ChatGPT ne visitent aucun site Web externe lors d’une recherche, contre 26,91 % des utilisateurs de Google. Rien de tout cela n’a été testé devant le tribunal et les accusés n’ont pas encore déposé leur réponse.
Un chiffre de coût l’accompagne. En utilisant les prix API publiés par OpenAI, le mémoire calcule que la génération d’un million d’articles d’actualité d’environ 500 mots coûterait environ 6 800 dollars et ne nécessiterait aucun journaliste ou éditeur, ce qu’il présente comme preuve que les produits rendent les fermes d’information de mauvaise qualité bon marché.
Deux accusations spécifiques sur la gestion d’OpenAI
Le mémoire indique qu’OpenAI a obtenu le New York Times Annotated Corpus, un ensemble de données de plus de 1,8 million d’articles publiés entre 1987 et 2007, sous une licence limitée à la recherche non commerciale, et s’y est quand même formé. Il indique également qu’immédiatement après le dépôt des poursuites, OpenAI a construit un « filtre Bloom » pour supprimer le contenu des plaignants dans les sorties, tout en laissant non filtré le contenu des éditeurs qui n’avaient pas intenté de poursuites. Les deux sont des allégations contenues dans le propre document des plaignants plutôt que des conclusions, et la réponse d’OpenAI n’y figure pas.
Les GPT personnalisés apparaissent également comme preuve, le dossier reproduisant les listes nommées « Bypass Paywall », « Remove Paywall » et « NYTimesGPT ». Cette plate-forme est en voie de disparition : OpenAI retire les GPT personnalisés et déplace leurs fonctions vers des plugins.
Rien de tout cela n’est une découverte
Un mémoire de jugement sommaire est un argument pour un juge, et non une décision de celui-ci. Le document est en partie expurgé, chaque citation qu’il contient est le choix des plaignants, et la défense d’usage loyal qu’il attaque n’a pas été tranchée dans cette affaire. OpenAI et Microsoft répondront avec leurs propres documents, et le juge pourra refuser la requête dans son intégralité.
Ce qui est inhabituel, c’est la liste des témoins. Les lignes les plus fortes des éditeurs viennent ici d’un directeur de Microsoft, d’un directeur général de Microsoft sous serment et du responsable de ChatGPT d’OpenAI, c’est pourquoi le dossier mérite d’être lu avant même qu’un juge n’en dise un mot.