Le New York Times et 11 autres publications poursuivent OpenAI et Microsoft pour leur utilisation de contenu protégé par le droit d'auteur de sites Web d'information pour former des modèles d'IA comme ChatGPT sans autorisation. Des documents internes obtenus par le tribunal révèlent que les deux sociétés ont activement contourné les paywalls et utilisé du contenu protégé pour former leurs systèmes d'IA, bien qu'elles sachent que c'était illégal. L'équipe juridique de Microsoft a reconnu qu'elles auraient exigé la recyclage des modèles si elles avaient eu connaissance de cette pratique. Les chercheurs de Microsoft ont exprimé des inquiétudes sur le fait que le scraping généralisé du contenu en ligne pourrait créer une "boucle stupide", où moins de contenu original conduit à des données de formation d'IA plus faibles. OpenAI a montré peu d'hésitation à acquérir toutes les informations disponibles, y compris des outils conçus pour briser les paywalls.
Lecture du biais (Centre): L'article présente des preuves factuelles tirées de documents judiciaires et de communications internes sans favoriser ouvertement l'une ou l'autre des parties.Il cite plusieurs sources, y compris des dirigeants de Microsoft et des représentants juridiques du New York Times, offrant une vision équilibrée du différend.





