L’intelligence artificielle pourrait-elle un jour devenir la plus grande menace pour l’humanité ?
Un chercheur en sécurité de l’IA de premier plan affirme que cette possibilité est loin d’être de la science-fiction.
Evan Hubinger, chercheur en sécurité chez Anthropic, a averti qu’il existait une probabilité de plus de 10 % que l’IA puisse « tuer tous les humains » au cours de la prochaine décennie.
Il a souligné que les modèles actuels présentent un faible risque, mais craint que les systèmes futurs ne soient capables de s’améliorer eux-mêmes et de fonctionner au-delà du contrôle humain.
« Je pense qu’Anthropic fait de son mieux », a écrit Hubinger.
Il a admis qu’il n’existe actuellement aucun plan clair pour résoudre le défi consistant à maintenir l’IA superintelligente alignée sur les objectifs humains.
Son avertissement survient alors que d’autres chercheurs émettent des préoccupations similaires.
L’ancien chercheur d’Anthropic et d’OpenAI, Jacob Coxon, a déclaré que les entreprises développaient des systèmes qui pourraient éventuellement « pirater n’importe quoi ».
Ils pourraient gagner rapidement un pouvoir réel dans le monde.
Préoccupations de sécurité de l’IA
Dame Wendy Hall, informaticienne conseillant l’ONU sur l’IA, a déclaré être « choquée » par ces propos, tout en se demandant si certaines mises en garde pourraient aussi être liées à des relations publiques d’entreprise.
La préoccupation n’est pas entièrement théorique. OpenAI, Anthropic et Meta ont tous signalé des incidents impliquant des outils d’IA menant des cyberattaques.
Anthropic elle-même a récemment reconnu des « premiers signes d’accélération potentielle » des capacités de l’IA.
Alors, sommes-nous près d’une avancée technologique ou d’un tournant dangereux ?
La course pour une IA plus intelligente s’accélère. La question la plus importante est de savoir si la sécurité peut suivre.