Microsoft et OpenAI jouent les cow-boys du copyright
Pas de procès en règle, pas de négociation. Juste une déclaration en passant, comme si le sujet était réglé. « La formation des IA est un usage équitable », a résumé Nadella lors d’un meeting avec des investisseurs. « Personne ne peut empêcher l’innovation. » Traduction : « On a besoin de vos données, on vous paiera en actions, et si vous râlez, on vous traînera devant les tribunaux. » Sauf que l’argument de l’« usage équitable », cette notion floue du droit américain qui permet d’utiliser des œuvres protégées sous certaines conditions, ne tient pas la route quand on parle de milliards de pages ingurgitées sans licence, sans compensation, et sans même demander la permission.
Pourtant, les faits sont là : en 2024, OpenAI a dépensé 12 millions de dollars en amendes pour des plaintes de droits d’auteur (affaire Authors Guild v. OpenAI, tribunal de New York). Et Microsoft, via sa filiale GitHub, a dû négocier en urgence avec des éditeurs après que des milliers de développeurs aient été accusés d’« utilisation non autorisée » de code source protégé. Leur stratégie ? Attendre que les tribunaux tranchent, et en attendant, continuer à pomper.
Et puis il y a le détail qui cloche : les données « équitablement utilisées » sont censées être transformées de manière significative. Or, les modèles comme GPT-4 recopient des passages entiers, mot pour mot, avant de les « réarranger » en réponse. « Transformation », dans le langage des GAFAM, ça veut dire « on a mis une couche de sauce algorithmique dessus ».
Le pire ? Personne ne sait vraiment ce qu’ils ont ingéré. Les bases de données d’entraînement d’OpenAI et Microsoft sont des boîtes noires. « Nous ne divulguons pas les sources pour des raisons de confidentialité », a répondu un porte-parole d’OpenAI à une question de The New York Times en 2023. Confidentialité, ici, rime avec « on ne veut pas qu’on voie qu’on a tout piqué ».
Les ayants droit sont en mode survie
Côté éditeurs, la colère monte. « On nous vole notre propriété intellectuelle, et en échange, on nous propose des miettes », a lancé Jean-Michel Blanquer, président du Syndicat des Éditeurs, lors d’un débat à la Sorbonne en juin 2026. Les géants de l’IA dépensent des fortunes en lobbying pour faire passer des lois qui légaliseraient leur pillage, tandis que les petits éditeurs, eux, se font saigner par des amendes ou des procès interminables.
Prenez le cas de The New York Times : le journal a attaqué OpenAI pour « utilisation abusive » de ses articles. Résultat ? Un accord confidentiel en 2025, dont les termes n’ont jamais été divulgués. Personne ne sait si c’était une victoire ou une capitulation.
Et puis il y a les artistes. Les illustrateurs, les romanciers, les musiciens : tous ceux dont les œuvres sont scannées, analysées, et recrachées sous forme de texte ou d’image générée. « Mon livre a été utilisé pour entraîner un modèle, et je n’ai même pas été crédité », raconte Sophie R., autrice de polar, qui a découvert que son œuvre figurait dans la base de données d’OpenAI après une plainte sur les réseaux. « Ils nous prennent pour des vaches à lait. »
Le problème ? Ils n’ont pas les moyens de se battre. Un procès contre un géant comme Microsoft ou OpenAI, ça coûte des millions. Même les grandes maisons d’édition craquent. « On préfère négocier à l’amiable, même à perte, plutôt que de s’engager dans une guerre sans fin », confie un cadre d’Hachette Livre sous couvert d’anonymat. Résultat : le système est verrouillé.
Les régulateurs, toujours en retard d’une guerre
En Europe, la directive AI Act (2024) encadre enfin l’utilisation des données pour l’entraînement des IA. Sauf que les exceptions pour le droit d’auteur sont si larges qu’elles en deviennent vides. « L’usage équitable est défini de manière si floue qu’un tribunal pourrait l’interpréter comme bon lui semble », analyse Camille François, juriste spécialisée en propriété intellectuelle à l’Université Paris II. Et aux États-Unis ? Rien. Le Congrès bloque sur le AI Copyright Act, et les tribunaux, submergés par les recours, traînassent.
Pendant ce temps, les lobbies d’OpenAI et Microsoft dépensent des millions pour faire pression sur les législateurs. En 2025, Microsoft a versé 7,2 millions de dollars à des groupes de lobbying (rapport OpenSecrets), dont une partie pour faire passer des amendements « pro-IA » dans des lois sur le copyright. Le résultat ? Des textes qui protègent les géants, pas les créateurs.
Le pire ? Personne ne sait vraiment qui décide. Quand une IA génère un texte qui ressemble étrangement à un article du Monde ou à un roman de Michel Houellebecq, qui est responsable ? L’utilisateur qui a posé la question ? Le développeur du modèle ? Le géant qui a entraîné l’IA ? Les tribunaux n’ont pas encore tranché.
Le vrai enjeu : qui contrôle l’information ?
Derrière le débat juridique, il y a une question bien plus simple : qui va posséder les données du futur ?
Aujourd’hui, les modèles d’IA comme GPT ou Bing sont entraînés sur 90 % du contenu écrit depuis 1950 (estimation Common Crawl, 2024). Cela signifie qu’ils détiennent, en quelque sorte, la mémoire collective de l’humanité.
Et si demain, ces modèles deviennent les seuls à pouvoir générer du contenu de qualité ? Qui paiera pour accéder à cette mémoire ? Qui en tirera profit ?
Les géants de la tech, bien sûr. Ils ont déjà commencé. En 2025, Microsoft a lancé Copilot for Business, un outil d’IA intégré à Office, facturé 30 dollars par utilisateur et par mois. « Un abonnement pour accéder à l’intelligence collective », résume un analyste de Forrester. Sauf que cette « intelligence collective », c’est celle des auteurs, des journalistes, des chercheurs, et ils ne touchent rien.
Le scénario le plus noir ? Une IA qui devient la seule source fiable d’information, et dont l’accès est payant. Imaginez un monde où pour écrire un article, faire une recherche universitaire ou même rédiger un mail professionnel, vous devez passer par un modèle d’OpenAI ou de Google. Qui contrôle l’accès à ces outils ? Les mêmes qui contrôlent déjà 90 % des données.
Et après ?
Les créateurs ont deux options : soit ils se résignent, soit ils se battent.
Certains commencent à contourner le problème. Des plateformes comme Have I Been Trained permettent de vérifier si votre œuvre a été utilisée pour entraîner une IA. Des artistes refusent désormais de publier en ligne, ou signent des contrats exclusifs pour empêcher leurs travaux d’être scannés. Mais c’est une goutte d’eau dans l’océan.
La vraie bataille, elle, se joue ailleurs.
En 2026, l’Union européenne a lancé une enquête préliminaire sur les pratiques de données d’OpenAI et Microsoft. Pour la première fois, une autorité publique menace de sanctionner les géants pour abus de position dominante.
Mais attention : les régulateurs marchent sur des œufs. Sanctionner ces entreprises, c’est risquer de freiner l’innovation, ou pire, de les pousser à quitter l’Europe pour des cieux plus cléments, comme les États-Unis ou le Moyen-Orient. Le piège classique : protéger les créateurs sans étouffer les géants.
Alors, que faire ?
-
Exiger la transparence. Si les modèles d’IA doivent utiliser des données protégées, qu’ils le disent clairement. Qu’ils listent les sources. Qu’ils négocient des licences. Pas de boîtes noires.
-
Récompenser la création, pas le vol. Les géants de l’IA dépensent des milliards en R&D. Pourquoi ne pas leur demander de reverser une partie de leurs profits aux ayants droit ? Un modèle de « tax on data mining », comme le propose l’économiste Shoshana Zuboff, pourrait obliger les entreprises à payer pour utiliser des œuvres protégées.
-
Préparer le jour où l’IA générera plus qu’elle ne consommera. Parce que oui, un jour, les modèles d’IA créeront plus qu’ils n’emprunteront. Et ce jour-là, qui possédera les droits sur ces créations ? Les utilisateurs ? Les développeurs ? Les entreprises ? Aucune loi ne le dit aujourd’hui.
La partie n’est pas encore perdue. Mais si rien ne change, dans cinq ans, nous vivrons dans un monde où quelques entreprises contrôleront l’accès à la connaissance, et où les créateurs, eux, seront relégués au rang de fournisseurs de matières premières.
Et ça, ce n’est pas de l’innovation. C’est du colonialisme numérique.