Les personnes payées pour former les modèles d'OpenAI sont licenciées pour avoir fait leur travail avec l'aide de l'IA, selon un rapport de 404 Media basé sur des documents internes et des entretiens avec trois sous-traitants.
L’ironie au centre de l’histoire est vive. Les chercheurs en IA ont mis en garde contre « l’effondrement des modèles » – la dégradation qui se produit lorsque les modèles sont de plus en plus entraînés sur du texte généré par l’IA. Certaines des personnes embauchées pour empêcher ce résultat utilisent elles-mêmes des réponses générées par l'IA pour former les modèles d'OpenAI, et l'appareil d'examen de l'entreprise les traque activement. Pour plus de contexte sur cette histoire, consultez notre couverture de l'industrie de l'IA.
"C'est à peu près la seule chose qui vous fera démarrer"
Un entrepreneur a déclaré à 404 Media qu'il voyait des travailleurs utiliser l'IA "tout le temps et que les gens étaient licenciés tout le temps, c'est à peu près la seule chose qui vous fera virer le plus tôt possible". La personne a ajouté que "par milliers, il y a des tonnes qui ont été capturées".
Le rapport s'appuie sur la révélation précédente de 404 Media sur le projet Lily, un effort OpenAI dans lequel des centaines d'entrepreneurs lisent les invites et les conversations de vrais utilisateurs de ChatGPT - qui peuvent inclure des informations personnelles - puis évaluent et critiquent les réponses du modèle, notamment en vérifiant que les réponses ne sont pas trop flagorneuses ou enclines à anthropomorphiser le chatbot.
Le nouveau rapport s'appuie sur des documents internes supplémentaires et des entretiens avec trois sous-traitants travaillant sur des projets OpenAI. Selon un document interne, ces projets peuvent impliquer plus de dix mille entrepreneurs.
Le livret de règles : pas de GPTZero, pas de grammaire, pas d'IA
Les documents examinés par 404 Media sont sans ambiguïté sur l'utilisation des outils. "N'utilisez pas d'outils de détection d'IA, ni l'IA vous-même", un document destiné aux sous-traitants qui examinent les états de travail des autres sous-traitants. "N'utilisez pas GPTZero ou tout autre outil de détection d'IA. Ils ne sont pas fiables. Les évaluateurs ne peuvent pas non plus utiliser l'IA, y compris la grammaire et la traduction par l'IA."
Le même document encourage les évaluateurs à rester discrets sur leurs méthodes : « Ne dites pas aux évaluateurs pourquoi vous soupçonnez l'IA. Il leur est plus facile de se cacher s'ils savent ce que vous recherchez. Jugez de la tendance générale, pas d'un indice. »
Les trois sous-traitants ont déclaré que les évaluateurs avaient pour instruction de ne pas utiliser l’IA dans leur travail, et deux ont déclaré que des personnes avaient été licenciées ou exclues pour l’avoir utilisée. 404 Les médias ont accordé l'anonymat aux entrepreneurs car ils n'étaient pas autorisés à parler à la presse.
Alors, qu’est-ce qui trahit un travailleur ? Selon le rapport, les évaluateurs sont invités à rechercher des signes révélateurs d'utilisation de l'IA : mots répétitifs, ponctuation de type IA – y compris, apparemment, utilisation trop zélée du tiret cadratin – et travail terminé inhabituellement rapidement. Dans les canaux Slack où les entrepreneurs échangent des conseils, a déclaré un entrepreneur, les gens publient fréquemment des exemples demandant : « Est-ce de l'IA ?
Un entrepreneur qui a admis avoir utilisé l'IA tout en aidant à former les modèles d'OpenAI a partagé ce qu'il a présenté comme sa lettre de résiliation. Il a indiqué que leur employeur avait identifié des problèmes avec « l'authenticité » de leur travail.
"Je ne suis pas une mauvaise personne ou un mauvais travailleur. J'avais juste besoin d'un petit coup de pouce et je me suis tourné vers l'IA pour m'aider, ce qui a finalement conduit à ma chute", a déclaré l'entrepreneur à 404 Media. "Je n'éprouvais aucune joie dans mon travail ni le sentiment de contribuer à la société d'une manière ou d'une autre."
Le rôle de Mercor et la chaîne de travail de formation en IA
Deux des sous-traitants travaillaient pour Mercor, une société de formation en IA qui embauche des sous-traitants qui examinent le matériel lié à ChatGPT. Un porte-parole de Mercor a déclaré à 404 Media dans un communiqué que ses experts sont embauchés pour leur expertise et leur jugement, que la société a décrit comme essentiels à l'avancement continu de l'IA, et que ses contrats interdisent strictement l'utilisation de l'IA dans le travail.
Cet arrangement met en évidence la structure de travail en couches derrière le développement de l’IA à la frontière. Des entreprises comme OpenAI s’appuient de plus en plus sur des fournisseurs spécialisés, qui recrutent à leur tour de vastes groupes de réviseurs indépendants – par milliers par projet – pour évaluer les résultats du modèle, signaler les contenus préjudiciables et maintenir les réponses fondées. Le contrôle de la qualité dans cette chaîne n'est pas appliqué par un logiciel mais par d'autres humains qui lisent des informations de type « IA ».
Pourquoi l'interdiction existe – et pourquoi elle est difficile à appliquer
La justification de cette interdiction est simple : si les humains évaluant les réponses de ChatGPT sous-traitent leurs jugements à ChatGPT lui-même, la boucle de rétroaction s'effondre. Les notes ne reflètent plus les véritables préférences humaines, l’effondrement du modèle s’accélère et les données d’évaluation qui guident la formation deviennent circulaires. Les propres documents d'OpenAI reconnaîtraient que les outils de détection de l'IA ne sont pas fiables, c'est pourquoi il est demandé aux évaluateurs de s'appuyer sur le jugement des modèles plutôt que sur les logiciels.
Mais l’application d’une règle de non-IA au sein d’une main-d’œuvre composée de milliers de pigistes, embauchés par des intermédiaires et payés à la tâche, crée ses propres pressions. Les entrepreneurs ont déclaré à 404 Media que l'utilisation de l'IA est courante même si les licenciements sont fréquents, et le travailleur anonyme qui a partagé une lettre de licenciement a décrit son recours à l'IA non pas par paresse mais comme « un petit coup de pouce » pour un travail qu'il trouvait sans joie.
Le rapport s'inscrit dans un débat plus large sur les conditions de travail de la main-d'œuvre invisible de l'industrie de l'IA : les annotateurs, évaluateurs et réviseurs dont le travail sous-tend chaque modèle majeur. Cela soulève également des questions inconfortables pour l’économie dans son ensemble : si les personnes payées pour distinguer l’écriture humaine de l’écriture automatique ont du mal à le faire de manière fiable, et que les détecteurs d’IA restent peu fiables selon l’évaluation d’OpenAI, les employeurs du monde entier se retrouvent à contrôler une frontière de plus en plus difficile à voir.
Pour l’instant, la politique au sein du pipeline de formation d’OpenAI est claire, tout comme la pénalité. Les travailleurs qui évaluent les résultats de l'un des systèmes d'IA les plus performants au monde sont censés être entièrement humains et vérifiables – et ceux qui choisissent l'outil qu'ils évaluent risquent de perdre leur emploi.
---
Restez à la Pointe de l'IALes dernières actualités, analyses et percées en IA — au même endroit.
Lire plus d'actualités IA →