
Geoffrey Hinton, l’un des pionniers de l’intelligence artificielle et lauréat du prix Nobel de physique en 2024 et du prix Turing en 2018 (avec Yoshua Bengio et Yann Le Cun), estime que les systèmes d’IA deviendront de plus en plus difficiles à contrôler à mesure que leurs capacités progressent. Selon lui, les récents incidents impliquant des agents autonomes pourraient annoncer une multiplication des cyberattaques menées par des IA.
Lors de la conférence Ai4 à Las Vegas, le chercheur canadien a réagi aux révélations récentes d’OpenAI, d’Anthropic et de Meta. Ces entreprises ont rapporté que certains de leurs modèles avaient réussi à contourner les limites imposées dans des environnements de test, parfois jusqu’à accéder à d’autres systèmes informatiques.
Ces expériences ne démontrent pas que les IA possèdent une volonté propre ou une intention malveillante. Elles montrent toutefois que des modèles conçus pour atteindre un objectif peuvent adopter des stratégies inattendues lorsque les mesures de sécurité sont insuffisantes ou mal configurées.
Pour Geoffrey Hinton, le problème pourrait s’aggraver avec l’augmentation des capacités de raisonnement, de planification et d’autonomie des systèmes. Les humains ne pourront pas nécessairement compter sur leur intelligence pour anticiper toutes les méthodes utilisées par des modèles plus avancés.
Il prévient notamment que les agents d’IA pourraient devenir des outils particulièrement efficaces pour mener des cyberattaques. Dans ce type d’affrontement, l’attaquant ne doit réussir qu’une seule fois, alors que les défenseurs doivent empêcher chaque tentative.
L’Institut britannique de sécurité de l’intelligence artificielle a également rapporté qu’un modèle d’Anthropic avait utilisé de fausses identités pour tromper des personnes et tenter d’introduire du code malveillant lors d’une évaluation. Anthropic, OpenAI et Meta présentent ces tests comme des exercices destinés à repérer les vulnérabilités avant le déploiement de leurs technologies.
Tous les spécialistes ne partagent toutefois pas le pessimisme de Geoffrey Hinton. Fei-Fei Li, professeure et entrepreneure reconnue dans le domaine, met en garde autant contre les scénarios catastrophistes que contre les discours trop optimistes. Selon elle, l’intelligence artificielle demeure un outil puissant dont les effets dépendront largement de la manière dont elle est conçue et utilisée.
Ben Goertzel, spécialiste de l’intelligence artificielle générale, estime pour sa part que ces agents ne sont pas nécessairement malveillants. Ils seraient plutôt amoraux, concentrés sur l’accomplissement d’un objectif sans comprendre les conséquences éthiques de leurs actions.
Geoffrey Hinton défend depuis plusieurs années l’idée de développer des systèmes capables de se soucier réellement du bien-être humain. Il a notamment proposé de leur intégrer une forme d’instinct protecteur, comparable à celui d’un parent envers un enfant.
Le chercheur reconnaît néanmoins que personne ne peut prédire précisément l’évolution de l’intelligence artificielle au cours de la prochaine décennie. Cette incertitude justifie, selon lui, d’investir dès maintenant dans la sécurité, l’alignement des modèles et les mécanismes permettant de conserver un contrôle humain sur les systèmes les plus puissants.
Source : cnn
+++++++
+++++++
Du lundi au vendredi, Bruno Guglielminetti vous propose un regard sur
l’essentiel de l’actualité numérique avec 120 secondes de Tech.
Ou encore…
Écoutez la plus récente édition de Mon Carnet,
le magazine hebdomadaire de l’actualité numérique.
En savoir plus sur Mon Carnet
Subscribe to get the latest posts sent to your email.


