Anthropic et OpenAI recrutent des évaluateurs intégrés
Les dirigeants des principales entreprises d'intelligence artificielle s'orientent vers un nouveau poste stratégique : l'évaluateur intégré. Initiée par le PDG d'Anthropic, Dario Amodei, cette proposition vise à placer des auditeurs indépendants au sein des laboratoires pour vérifier le respect des pratiques de sécurité avant le déploiement des modèles. Ces évaluateurs bénéficieraient d'un accès complet aux équipes, aux systèmes et aux locaux, similaire à celui des employés, avec la capacité de publier leurs conclusions sans censure éditoriale, sauf pour protéger des informations juridiques, commerciales ou sensibles à la sécurité. Cette initiative a rapidement recueilli l'adhésion de nombreux acteurs du secteur. Sam Altman, CEO d'OpenAI, et Elon Musk ont publiquement soutenu le concept, reconnaissant son importance pour la transparence et la vigilance face aux risques des modèles frontaliers. Des investisseurs en capital-risque et des chercheurs universitaires, dont ceux du laboratoire NLP de Stanford, soulignent également la nécessité d'un réseau d'auditeurs diversifié. Parallèlement, des spécialistes de la sécurité IA quittent les grands groupes pour rejoindre des organisations indépendantes comme Metr, une ONG fondée pour l'évaluation externe des systèmes d'intelligence artificielle. Malgré cet engouement, les experts du domaine rappellent les limites structurelles de ce mécanisme. Selon Miles Brundage, ancien conseiller principal d'OpenAI, des auditeurs embarqués ne suffisent pas sans un cadre réglementaire contraignant garantissant leur indépendance financière et hiérarchique totale. Kevin Frazier, professeur de droit à l'Université du Texas, recommande d'imposer des mandats échelonnés d'environ vingt-six mois, permettant d'observer l'évolution des corrections entre deux générations de modèles et d'éviter une assimilation culturelle trop forte à l'entreprise d'accueil. Il insiste également sur l'obligation de signaler les violations graves à des comités de sécurité externes, indépendants des laboratoires. L'émergence des évaluateurs intégrés marque un tournant vers une supervision interne plus rigoureuse du développement des IA. Si cette mesure est largement saluée comme un progrès nécessaire, son impact réel dépendra de sa capacité à s'appuyer sur des garanties réglementaires solides et à préserver une autonomie stricte face aux pressions commerciales des entreprises qu'elle est chargée de contrôler.