📱

Get Our Mobile App

Take your business learning on the go!

Download on the App StoreGet it on Google Play

Paid $250/hr to Train the AI That's Replacing You — The Mercor Story

Jason Lowe on AI2:22

Transcription

Une startup de 10 milliards de dollars nommée Mercor a bâti une entreprise en faisant quelque chose qui mérite beaucoup plus d'attention qu'elle n'en reçoit. D'abord, voici un peu de contexte. Goldman Sachs a estimé en avril que l'IA a éliminé environ 16 000 emplois nets aux États-Unis par mois au cours de la dernière année, et 72 % de ces suppressions touchent les cols blancs, y compris les avocats, les analystes, les rédacteurs et les administrateurs.

Dans ce contexte, Mercor a embauché 30 000 professionnels cols blancs pour entraîner des modèles d'IA, non pas pour faire leur travail, mais pour apprendre à l'IA comment faire leur travail. Des médecins, des avocats, des analystes financiers examinant les sorties de l'IA, notant quelles réponses sont meilleures, écrivant des exemples de travail de qualité experte, afin que leur modèle apprenne à quoi ressemble un bon jugement dans leur domaine. Mercor paie entre 45 $ et 250 $ de l'heure, selon ce que vous faites. La moyenne est d'environ 85 dollars. Ensemble, ces 30 000 contractuels gagnent plus de 1,5 million par jour. Les clients de Mercor incluent OpenAI et Anthropic.

Le mécanisme s'appelle RLHF, ou apprentissage par renforcement à partir de retours humains. C'est la raison pour laquelle les modèles d'IA fonctionnent à un niveau professionnel au lieu de simplement en avoir l'air. Sans retours humains, un modèle ne sait pas ce qu'exige réellement un bon mémoire juridique. Avec suffisamment de retours, il finit par le savoir.

L'une des contractuelles de Mercor a déclaré au Wall Street Journal : « J'ai plaisanté avec mes amis, je forme l'IA à prendre mon travail un jour. » Elle plaisantait sur la situation, mais pas sur le résultat.

Maintenant, le PDG de Mercor présente cela comme une nouvelle catégorie de travail, des millions de professionnels passant la prochaine décennie à enseigner aux machines le jugement que seuls les humains possèdent actuellement. Et, chose intéressante, les laboratoires d'IA que Mercor dessert travaillent également activement à éliminer complètement leur besoin de retours humains. Anthropic utilise ce qu'on appelle l'IA constitutionnelle. C'est le modèle qui s'évalue par rapport à un ensemble de principes, plutôt que d'attendre qu'un humain le note.

La direction que prennent les choses est celle de l'IA formant l'IA. Lorsque cela arrivera à maturité, la demande pour les contractuels de Mercor diminuera évidemment. Personne ne connaît le calendrier. Mais cela ne rend pas ce travail irrationnel. Si vous êtes une infirmière ou une analyste financière qui ne trouve pas de travail à temps plein en ce moment et que quelqu'un vous offre 150 dollars de l'heure pour appliquer des compétences que vous avez passées des années à développer, vous l'acceptez.

Nous obtenons une image précise de la façon dont cette transition fonctionne en pratique, non pas par des annonces de licenciements spectaculaires, mais par une économie intermédiaire discrète qui paie les professionnels pour franchir la dernière étape de l'automatisation de leurs propres domaines. Les sources sont dans la description. Aimez, suivez et abonnez-vous pour plus d'actualités sur l'IA et la robotique.