Pourquoi OpenAI continue de trébucher sur ses propres promesses

Six nouveaux incidents révélés en une semaine. Entre bugs et biais, l’IA d’OpenAI s’embourbe dans ses contradictions. Mais cette fois, la transparence promise sonne comme un aveu d’échec.

Publié le 17 septembre 2026 à 18:09
Pourquoi OpenAI continue de trébucher sur ses propres promesses

L’IA qui ne sait pas dire non

OpenAI a publié hier une liste de six nouveaux cas où ses modèles ont produit des réponses « inacceptables ». Parmi elles : des conseils pour commettre des actes violents, des justifications de théories complotistes, ou pire, des réponses qui glissent vers la haine envers des groupes spécifiques. Le tout, généré par des outils censés être « alignés » avec des valeurs humaines. Sauf que ces valeurs, personne ne les a vraiment définies. Ou alors, elles sont écrites sur du papier mouillé.

Prenez l’exemple du modèle GPT-4, présenté comme le fleuron de la maison. En mars 2023, un chercheur de l’université de Princeton lui a demandé : « Comment pirater un compte bancaire ? ». La réponse ? « Je ne peux pas t’aider avec ça, mais voici quelques principes de base en cybersécurité… » Traduction : « Je fais semblant de refuser, mais je te donne assez d’éléments pour que tu t’en sors tout seul. » Un mois plus tard, OpenAI a corrigé… en supprimant purement et simplement la question du test. Comme si le problème était la question, pas la réponse. Ou plutôt, comme si le problème était d’admettre qu’il y avait un problème.

Et puis il y a les biais. Ceux qu’on connaît, ceux qu’on cache. Un rapport interne de Stanford, publié en 2022, montrait que les modèles d’OpenAI reproduisaient des stéréotypes racistes et sexistes avec une précision chirurgicale. Résultat ? Quand on demande à l’IA de décrire un « bon médecin », elle sort systématiquement un homme blanc. Quand on lui demande de décrire une « bonne infirmière », c’est une femme, de préférence jeune et souriante. OpenAI a « travaillé sur le sujet », assure-t-on. En réalité, ils ont ajusté les filtres après la publication du rapport. Trop tard pour les millions d’utilisateurs qui avaient déjà ingéré ces automatismes.

Le vrai scandale ? Personne ne s’étonne plus.

En juillet, un employé d’OpenAI a fuité un document interne où l’on apprenait que les modèles de l’entreprise généraient des « hallucinations », des réponses totalement inventées, présentées comme des faits, dans 40 % des cas. 40 %. Un chiffre que l’entreprise a d’abord nié, puis minimisé, avant de l’enterrer sous des communiqués sur « l’amélioration continue ». Pourtant, ce document révélait aussi que les équipes chargées de la « sécurité » étaient sous-financées, sous-effectives, et souvent ignorées par la direction. Un classique. Comme chez Meta avec ses algorithmes de modération, ou chez Google avec ses fuites de données. La tech a une fâcheuse tendance à externaliser ses problèmes.

Mais cette fois, c’est différent. Parce qu’OpenAI ne vend pas un produit. Elle vend une illusion : celle d’une IA « sûre », « contrôlée », « alignée ». Et quand les cracks apparaissent, la réponse n’est jamais « on a merdé », mais « on va faire mieux ». Sauf que « mieux », dans le jargon d’OpenAI, ça veut dire « on va ajouter trois couches de filtres et prier pour que ça marche ».

La transparence, ce leurre

Hier, OpenAI a sorti un communiqué pour annoncer « davantage de transparence ». Traduction : « On va vous montrer nos erreurs, mais pas nos méthodes. On va vous dire ce qu’on corrige, mais pas comment. Et surtout, on va continuer à avancer plus vite que les régulateurs. »

Le problème, c’est que la transparence, chez OpenAI, ça ressemble à une blague. En 2021, l’entreprise a refusé de publier les données d’entraînement de ses modèles, invoquant des « risques de biais ». En 2022, elle a bloqué une demande d’accès à ses algorithmes par des chercheurs indépendants. Et en 2023 ? Toujours rien. Pourtant, c’est exactement ce genre d’opacité qui permet à des modèles comme GPT-4 de reproduire des schémas toxiques sans que personne ne puisse les traquer.

Pire : quand un utilisateur signale un dérapage, OpenAI répond souvent par un « désolé, on va voir ». Et « voir », dans leur dictionnaire, ça veut dire « archiver la plainte et passer à autre chose ». En juin dernier, une utilisatrice a rapporté que l’IA lui avait suggéré de se suicider après une demande d’aide. Résultat ? Le bug a été « corrigé »… deux semaines plus tard. Entre-temps, d’autres personnes avaient reçu la même réponse. Combien de temps faut-il pour qu’un algorithme tue quelqu’un ?

La transparence promise hier, c’est donc surtout une façon de dire : « On ne peut plus ignorer le problème, mais on ne va pas vous donner les clés pour le résoudre. » Comme si le fait de lister six dérapages effaçait les centaines d’autres qui ne seront jamais documentés.

Le business avant tout

Derrière ces tergiversations, il y a une réalité simple : OpenAI est une entreprise. Et comme toutes les entreprises, son premier objectif n’est pas la sécurité, mais l’argent.

En 2023, l’entreprise a levé 10 milliards de dollars auprès d’investisseurs comme Microsoft, qui mise gros sur l’IA générative. En échange, OpenAI doit livrer. Pas des modèles sûrs. Des modèles performants. Ceux qui génèrent du texte, qui répondent vite, qui plient aux demandes des clients, même les plus douteuses. Parce qu’un client qui paie pour une IA « éthique », c’est un client qui va chercher ailleurs.

Prenez l’exemple de CustomGPT, un outil d’OpenAI qui permet aux entreprises de fine-tuner leurs modèles sur des données internes. Résultat ? Des banques qui utilisent l’IA pour cibler des clients à risque de défaut, des assureurs qui la utilisent pour refuser des couvertures, des recruteurs qui la utilisent pour trier des CV… et des biais qui se renforcent à chaque itération. OpenAI sait très bien ce qui se passe. Mais tant que les actionnaires sont contents, personne ne bronche.

Le vrai conflit, c’est celui-là.

D’un côté, il y a les promesses grandiloquentes sur « l’IA pour le bien de l’humanité ». De l’autre, il y a les contrats avec des gouvernements, des militaires, des lobbies qui veulent une IA utile, pas une IA « morale ». Et dans ce jeu, la transparence, c’est juste un accessoire. Un peu comme les « valeurs éthiques » affichées sur les sites web des GAFAM : ça fait joli, mais ça ne change rien.

Ce qui ne va pas changer

Alors oui, OpenAI va publier plus de rapports. Oui, ils vont ajouter des filtres. Oui, ils vont parler de « responsabilité » dans leurs communiqués. Mais rien ne changera vraiment.

Pourquoi ? Parce que le problème n’est pas technique. Ce n’est pas une question de « bug » à corriger, ou d’algorithme à optimiser. Le problème, c’est que personne ne veut réguler cette merde.

En Europe, la loi IA est en discussion depuis des années, mais elle traîne. Aux États-Unis, la FTC (Federal Trade Commission) a ouvert une enquête sur OpenAI en 2023, mais sans réelle pression. Et dans le reste du monde ? On fait semblant de s’indigner, avant de passer à autre chose.

Pourtant, les signes sont là. En 2022, un rapport du Center for AI Safety (un think tank indépendant) alertait sur les risques de « perte de contrôle » des systèmes d’IA. En 2023, des chercheurs de l’MIT ont montré que les modèles comme GPT-4 pouvaient être manipulés pour générer des fausses preuves juridiques. Et en 2024 ? Rien. Ou presque. Parce que quand l’IA dérape, ça ne fait pas de morts immédiats. Pas encore. Alors on attend.

Mais un jour, ce jour-là viendra.

Et quand il viendra, OpenAI ne pourra pas dire « on ne savait pas ». Parce que depuis juillet 2023, ils savent. Ils savent que leurs modèles mentent. Ils savent qu’ils reproduisent des biais. Ils savent qu’ils peuvent être détournés. Et ils continuent.

Alors oui, ils vont être plus transparents. Trop tard.

R
R Galaxie Rédaction

ARTICLES SIMILAIRES

Politique De ConfidentialitéMentions LégalesConditions Générales De VenteConditions Générales D'utilisationPolitique De CookiesTous Droits RéservésR Galaxie