Un mail qui sent le soufre et l’hypocrisie tech
Le 15 novembre 2022, un cadre de Microsoft, l’homme qui aide à former les modèles d’IA de la boîte, envoie un mail interne. Le ton est sec, presque désespéré. « On est en train de copier des articles entiers, des millions, et personne ne semble s’en apercevoir. » Pas de métaphores, pas de jargon. Juste un constat : OpenAI et Microsoft ont scanné des centaines de millions de pages de presse, dont celles du New York Times, pour nourrir ChatGPT. Et ça, c’est du vol pur et simple.
Pourtant, ce mail est resté dans l’ombre. Jusqu’à ce que le NYT le sorte des archives, en pleine bataille judiciaire. Parce que oui : le journal attaque OpenAI et Microsoft pour violation massive des droits d’auteur. Et ce mail, c’est une preuve de plus que les géants tech savent très bien ce qu’ils font. Ils le savent. Et ils continuent.
Le chiffre qui fait mal : 300 millions de pages, dont 90 % protégées
On connaît les chiffres maintenant. 300 millions de pages ont été ingurgitées par les algorithmes d’OpenAI. Parmi elles : 90 % de contenus sous copyright, selon une étude de l’Université de Princeton citée dans le dossier du NYT. Des articles, des livres, des rapports… tout y passe. Et devinez qui est en première ligne ? Les médias. Le Times, mais aussi The Guardian, The Washington Post, The Atlantic… La liste est longue.
Pourtant, personne ne crie au scandale. Pourquoi ? Parce que les géants tech ont une astuce : ils ne disent pas « on copie ». Ils disent « on utilise des données ». Comme si un repas volé dans un restaurant était acceptable si on le présente sous forme de données brutes. C’est du droit d’auteur, pas de la science-fiction.
Le mail qui prouve tout (et que Microsoft veut étouffer)
Revenons à ce cadre de Microsoft. Son nom ? On ne le sait pas. Son mail ? Un avertissement clair : « Si on se fait prendre, ça va être la guerre. Les médias vont nous poursuivre, et on n’aura pas de défense solide. » Sauf que Microsoft a choisi de ne rien changer. Au lieu de nettoyer ses bases de données, ils ont négocié en douce avec certains journaux. Des accords confidentiels, des chèques discrètement glissés. Assez pour faire taire les plus bruyants. Pas assez pour régler le problème.
Le NYT a eu le courage de porter plainte. Pourquoi eux ? Parce qu’ils ont les moyens. Parce qu’ils ont les preuves. Parce que, contrairement à la plupart des médias, ils osent dire « non ».
L’IA, c’est comme un restaurant qui pille vos plats
Imaginez un scénario : vous êtes chef étoilé. Un jour, un type entre dans votre cuisine, prend vos recettes, vos ingrédients, vos techniques… et ouvre un restaurant avec. Sans vous demander l’autorisation. Sans vous payer. Sans même vous remercier.
Vous porteriez plainte. Vous auriez raison.
Sauf que dans le monde de l’IA, ça s’appelle « formation de données ». Et tout le monde trouve ça normal. Pourquoi ? Parce que les géants tech paient des avocats assez chers pour que le débat reste flou. Parce que les régulateurs ferment les yeux. Parce que personne ne veut gâcher la fête.
Le problème, c’est que l’IA ne crée rien. Elle recrache. Elle mélange. Elle plagie. Et si vous lui demandez d’écrire sur un sujet précis, elle puise dans ce qu’elle a dévoré. Sans citer ses sources. Sans payer les auteurs. Sans rien.
Pourquoi les régulateurs ne bougent pas ?
L’Union européenne, avec son AI Act, veut encadrer l’IA. Très bien. Sauf que les lobbies tech sont partout. Microsoft, Google, Meta… Ils financent les études, ils influencent les lois, ils font traîner les débats. Résultat ? Les règles arrivent trop tard. Ou pas du tout.
Aux États-Unis, c’est pire. Aucune loi claire. Juste des procès qui traînent, des accords à l’amiable, et des milliards dépensés en avocats pour faire durer le conflit. L’objectif ? Usurer l’adversaire.
Le NYT a les moyens. Les petits médias, non. Donc le pillage continue.
ChatGPT sait tout… mais ne cite rien
Demandez à ChatGPT d’écrire sur un sujet récent. Il le fera. Avec des phrases bien tournées. Des détails précis. Des analyses qui ressemblent à du journalisme.
Sauf que rien n’est cité. Pas une source. Pas un auteur. Pas un lien. Juste du texte, sorti de nulle part. Comme si vous aviez volé un livre et que vous le revendiez en disant « c’est à moi ».
Pourtant, personne ne s’en offusque. Pourquoi ? Parce que l’IA, c’est « l’avenir ». Parce que « ça va changer le monde ». Parce que les géants tech ont réussi à faire croire que le vol de contenus, c’est un mal nécessaire.
La question qui tue : et si c’était illégal… mais que personne n’ose le dire ?
Voilà le vrai problème. Tout le monde sait. Les cadres de Microsoft. Les ingénieurs d’OpenAI. Les avocats des médias. Les régulateurs. Mais personne ne veut assumer.
Parce que si on reconnaît que c’est du vol, il faut arrêter. Il faut rendre l’argent. Il faut changer de modèle. Et ça, aucun géant tech ne le veut.
Alors on fait semblant de rien. On parle d’« innovation ». On parle de « progrès ». On parle de « l’avenir ». Mais on ne parle pas de justice.
Le procès du NYT pourrait tout changer
Le Times a osé. Ils ont porté plainte. Ils ont sorti les mails internes. Ils ont montré les preuves. Et ça fait peur.
Parce que si le NYT gagne, tous les médias vont suivre. Parce que si la justice reconnaît que l’IA a copié illégalement, alors il faudra redistribuer. Il faudra payer. Il faudra changer les règles du jeu.
Microsoft et OpenAI savent ça. C’est pour ça qu’ils tergiversent. Pour ça qu’ils négocient en secret. Pour ça qu’ils espèrent que le procès traînera assez longtemps pour que tout le monde oublie.
Mais une chose est sûre : ce mail interne va tout faire basculer.
Et après ? Personne ne sait.
Parce que le vrai combat, ce n’est pas contre OpenAI ou Microsoft. C’est contre un système qui trouve normal de voler pour innover.
Et jusqu’à présent, personne n’a encore gagné.