Quelques jours après qu’un salarié démissionnaire d’Anthropic a lancé l’alerte sur la menace que fait peser l’intelligence artificielle (IA) sur l’humanité, son patron, Dario Amodei, réagissait par ce qui ressemble à une solution. Dans un texte publié en ligne, il préconise que les laboratoires d’IA ralentissent leurs recherches les plus avancées pour répondre aux risques de voir cette technologie devenir incontrôlable.

À première vue, cela semble raisonnable. Anthropic se présente elle-même comme l’une des entreprises d’IA les plus pointilleuses en matière de sécurité, et Amodei a expliqué qu’il était à la tête d’une “course vertueuse” pour instaurer des garde-fous que devront respecter les autres concepteurs d’IA puissantes. Mais cet objectif était certainement illusoire dès le départ.

Le flou sur la méthode

Car plus la puissance des agents d’IA s’accroît, plus ils risquent de duper les utilisateurs et plus ils deviennent difficiles à contrôler. Dès lors, l’ambition d’Amodei et d’autres acteurs de l’IA, comme Sam Altman, d’OpenAI, de créer une superintelligence [l’IA générale, qui dépasserait en capacité les humains] apparaît de plus en plus incompatible avec les exigences de sécurité. Les dangers inhérents au développement de tels modèles sont peut-être tout simplement démesu