Ils devaient améliorer l’IA d’OpenAI, mais ont été virés pour avoir utilisé de l’IA
Des prestataires chargés d’améliorer les modèles d’OpenAI ont été écartés pour avoir utilisé eux-mêmes de l’IA, rapporte 404 Media le 22 septembre 2026. Une situation ironique qui s’explique par leur mission : apporter un jugement humain.
Dans de nombreux métiers, l’IA promet de faire gagner du temps. Mais l’utiliser peut aussi vous coûter votre mission. Selon une enquête de 404 Media publiée le 22 septembre 2026, plusieurs prestataires participant à l’amélioration des modèles d’OpenAI ont été écartés pour avoir… utilisé de l’IA dans leur travail.
Le média s’appuie sur des documents internes et les témoignages de trois prestataires travaillant sur différents projets d’OpenAI, dont deux évoquent des exclusions liées à cet usage. Il ne s’agit pas de salariés licenciés directement par OpenAI.
Mercor, l’un des sous-traitants concernés, confirme que ses contrats interdisent l’utilisation de modèles de langage pour accomplir ces missions et affirme retirer des projets les personnes dont l’infraction est établie. OpenAI a refusé de commenter.

Leur travail : juger les réponses de ChatGPT
Pour améliorer ChatGPT, certains prestataires examinent les conversations de ses utilisateurs. C’est notamment le cas dans le projet Lily, décrit dans une précédente enquête de 404 Media : des centaines de personnes lisent ces échanges, qui peuvent contenir des informations personnelles, et jugent les réponses du chatbot. Elles doivent notamment vérifier qu’il ne cherche pas trop à donner raison à l’utilisateur ou ne se présente pas comme un être humain. 404 Media ne précise pas si les personnes écartées pour avoir utilisé de l’IA travaillaient sur ce projet.
Pour comprendre l’intérêt de ces tâches, il faut distinguer la capacité d’un modèle à générer du texte de celle à fournir une réponse utile et adaptée à la demande. Une réponse peut être parfaitement rédigée, mais ne pas respecter la consigne ou affirmer quelque chose de faux avec beaucoup d’assurance.
Les retours humains permettent notamment d’orienter ces comportements. En janvier 2022, lors de la présentation d’InstructGPT, OpenAI expliquait demander à des personnes de rédiger des exemples de bonnes réponses et de classer différentes propositions du modèle.
Ces comparaisons servaient ensuite à ajuster celui-ci grâce à l’apprentissage par renforcement à partir de retours humains, ou RLHF. L’enquête de 404 Media ne précise toutefois pas comment les évaluations sont utilisées dans chacun des projets concernés.
Concrètement, un évaluateur peut devoir comparer deux réponses à une même question et indiquer laquelle est la meilleure. S’il confie ce choix à un chatbot, l’entreprise recueille le jugement d’une autre IA, alors qu’elle attend celui d’un humain. Le problème dépasse donc le simple raccourci pour travailler plus vite : l’évaluation fournie n’est pas celle qui était demandée.

Repérer l’IA… sans utiliser de détecteur d’IA
Reste à repérer ces usages. Selon les consignes rapportées par 404 Media, les personnes chargées de contrôler le travail des prestataires ne doivent pas utiliser de détecteurs d’IA, jugés peu fiables. Un document interne exclut notamment GPTZero. Il interdit aussi aux contrôleurs de recourir eux-mêmes à l’IA pour rédiger leurs commentaires, y compris à des outils de traduction par IA.
À la place, ils doivent rechercher plusieurs indices : des formulations répétitives, certaines habitudes de ponctuation ou des tâches terminées très rapidement. Le document leur demande également de ne pas expliquer aux prestataires ce qui a éveillé leurs soupçons, afin d’éviter qu’ils apprennent à contourner les contrôles. Il précise toutefois qu’il faut examiner un ensemble de signes plutôt qu’un indice isolé.
Car dans les faits, aucun de ces éléments ne constitue, à lui seul, une preuve. Un texte répétitif peut parfaitement avoir été écrit par un humain, tout comme une tâche peut avoir été accomplie rapidement sans assistance. Reste que l’ironie demeure : même dans l’industrie de l’IA, déléguer son travail à un chatbot peut vous coûter votre mission.
Toute l'actu tech en un clin d'œil
Ajoutez Numerama à votre écran d'accueil et restez connectés au futur !
Un édito exclusif, un guide, une reco de lecture et l’agenda de la rédaction : c’est ce que vous trouverez tous les jeudis dans ToujoursPlus, la newsletter tech écrite par Julien Cadot. Inscrivez-vous gratuitement ici !
Toutes les infos sur ChatGPT
- Claude Opus 5.5 et GPT-6 Sol sortent le même jour : Anthropic et OpenAI ont du mal à « ralentir » l’IA
- Vous avez trop de réunions ? Ce petit badge qui enregistre et résume vos réunions grâce à l’IA perd 51 € pour la rentrée
- Anthropic appelle à ralentir la course à l’IA… mais envisagerait déjà un nouveau modèle face à OpenAI
- La course aux modèles les plus puissants s’intensifie : 4,4 mois séparent les modèles open source des géants de l’IA
- Controverse autour de la solution Navier-Stokes par OpenAI : le chercheur d’Anthropic sort du silence
KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.