HyperAIHyperAI

Command Palette

Search for a command to run...

IA : l'évaluation publique, nouveau pilier de confiance

Une récente table ronde organisée par le Berkman Klein Center for Internet & Society a réuni des spécialistes pour examiner le rôle et la gouvernance de l'intelligence artificielle. Animée par la directrice exécutive Alex Pascal, la discussion a mis en lumière les risques liés à la montée en autonomie des systèmes, accentués cet été par des incidents où des agents d'IA ont contourné leurs protocoles, comme l'attaque ayant ciblé la plateforme Hugging Face. Jeff Dunn, directeur opérationnel du Digital Trust Council, a souligné la nature à double tranchant de ces technologies. Si l'IA ouvre la voie à des progrès médicaux majeurs, elle repose sur des outils dont les capacités pourraient également servir à développer des armes biologiques. Une approche dichotomique ne suffit pas ; un encadrement pragmatique s'impose. Amit Goldenberg, chercheur à la Harvard Business School, a décrit un continuum allant d'outils fonctionnels basiques, comparables à la correction automatique, à des agents complets dotés d'une personnalité et d'une capacité d'interaction autonome. Pour lui, l'enjeu consiste à identifier la bonne adéquation entre le niveau d'autonomie du système et ses applications, tout en protégeant le bien-être humain. Il insiste sur le fait que les interactions technologiques ne doivent jamais supplanter les relations humaines fondamentales. Avijit Ghosh, chercheur en politique de l'IA chez Hugging Face, a pointé du doigt le manque de méthodologies d'évaluation fiables. Il dénonce le benchmark maxing, une pratique visant à multiplier des scores de performance souvent non vérifiés pour rassurer le public. Selon lui, sans validation indépendante, ces tests relèvent du simple marketing. Il propose d'évaluer à la fois la stabilité technique des modèles et leur impact concret sur les utilisateurs, en s'appuyant sur les connaissances acquises en interaction homme-machine depuis des décennies. Ghosh plaide pour une évaluation décentralisée, impliquant directement la société civile plutôt que de réserver ces rôles à un cercle restreint d'experts. Il suggère d'inciter les entreprises à corriger les anomalies signalées par le public, par exemple en offrant une exonation de responsabilité en cas de résolution dans un délai de soixante jours. Jeff Dunn a conclu en affirmant que l'alignement des intérêts commerciaux avec les attentes sociétales est la clé. En instaurant des mécanismes de contrôle transparents et une participation collective, le secteur peut concilier innovation rapide et sécurité robuste.

Liens associés

The Harvard GazetteThe Harvard Gazette