Le New York Times a un problème avec OpenAI. Pas un problème de lecteurs, pas un problème de crédibilité, mais un problème de propriété intellectuelle. Et ce problème, c’est qu’on leur a piqué leurs articles. En masse. Pas quelques-uns, pas des extraits, mais des centaines. Suffisamment pour que le journal, l’un des plus respectés au monde, ait enfin décidé de crier au vol. Et ça, c’est nouveau. Ça, c’est gros. Ça, c’est la preuve que même les titans de l’information commencent à réaliser qu’ils sont en train de se faire dévaliser par des algorithmes affamés de données, sans un seul remords de la part de ceux qui les construisent.
**Le chiffre qui résume tout : 3 000 articles, 1,5 milliard de mots
Le NYT l’a annoncé sans détour : entre 2022 et 2023, OpenAI a utilisé 3 000 de ses articles pour entraîner ses modèles d’intelligence artificielle, dont ChatGPT. Soit 1,5 milliard de mots, selon les estimations du journal. Assez pour remplir 3 000 livres de 500 pages chacun. Assez pour former un modèle capable de répondre à vos questions comme s’il avait lu tout ça. Sauf que non. Parce que le NYT n’a jamais donné son accord. Et ça, c’est le cœur du problème.**
**Pourquoi le NYT se bat cette fois
Ce n’est pas la première fois qu’un média accuse OpenAI ou ses concurrents de se servir de leurs contenus sans permission. Mais cette fois, c’est différent. Le NYT n’est pas un petit blog ou un site marginal. C’est une institution. Et quand une institution parle, les autres écoutent. Surtout quand elle menace de poursuivre OpenAI en justice pour violation de copyright.
Pourquoi maintenant ? Parce que le NYT a compris une chose simple : si OpenAI peut se servir de leurs articles gratuitement, alors personne ne paiera plus pour du contenu de qualité. Les abonnés, les annonceurs, les investisseurs… Tout le monde se dit : « À quoi bon payer, si une IA peut faire le boulot à moindres frais ? » Et ça, c’est une menace directe pour leur modèle économique.
**Le vrai problème : personne ne sait comment réguler l’IA
Le NYT a raison sur un point : ce qui s’est passé est illégal. Le droit d’auteur, c’est le droit d’auteur. Point. Mais le problème, c’est que personne ne sait comment faire respecter cette loi face à des algorithmes qui grignotent tout sur leur passage.
Les régulateurs ferment les yeux. Les gouvernements tergiversent. Et les géants de la tech, eux, continuent de se remplir les poches avec des données volées. En 2023, une étude de l’Université de New York a montré que 90 % des données utilisées pour entraîner les modèles d’IA provenaient de sources non autorisées. 90 %. Vous avez bien lu. Et personne ne bronche.
Pourquoi ? Parce que l’IA, c’est l’or noir du XXIe siècle. Et comme pour le pétrole, ceux qui contrôlent les réserves ont les moyens de faire taire les protestations.
**Ce que ça change pour vous
Vous, lecteur, vous ne verrez peut-être pas la différence tout de suite. ChatGPT continuera de vous répondre, Google restera dominant, et les médias continueront de se battre pour des miettes. Mais à long terme, ce qui est en train de se jouer, c’est la fin du journalisme indépendant.
Si les algorithmes peuvent tout copier, tout réutiliser, sans jamais payer, alors qui va encore investir dans l’information de qualité ? Qui va encore prendre le risque de payer des journalistes, des photographes, des éditeurs, si tout peut être généré par une machine ?
Le NYT a raison de se battre. Pas seulement pour lui, mais pour tous ceux qui croient encore que l’information a de la valeur. Parce que si on laisse faire, demain, vous ne paierez plus pour lire un article. Vous paierez pour ne pas lire une version générée par une IA, pire que du spam. Et ça, ce n’est pas une utopie. C’est déjà en train d’arriver.
**La vraie question : et après ?
Le NYT va gagner son procès ? Peut-être. Mais même s’il gagne, ça ne changera rien à la tendance de fond : l’IA va continuer à se nourrir des contenus des autres, sans jamais demander la permission.
Alors la vraie question, ce n’est pas « OpenAI a-t-il volé des articles ? ». C’est « Qui va payer pour l’information, quand tout le monde peut se servir gratuitement ? »
Et la réponse, vous la connaissez déjà. Personne.
Parce que quand l’IA a faim, elle mange tout. Même les journaux.