La démission d’un chercheur d’Anthropic face à la menace d’attaques informatiques autonomes et de cyber-pandémies: les risques d’une IA générale capables de menacer l’humanité sont-ils fondés ?
DAVID : « Ouvre les portes de l’aéroport spatial, HAL. »
HAL : « Désolé, Dave. J’ai peur de ne pas pouvoir le faire. »
DAVID : « Pourquoi donc ? »
HAL : « Dave, je sais que toi et Frank aviez décidé de me déconnecter, et c’est un risque que je ne peux pas laisser courir. »
DAVID : « Comment sais-tu ça, HAL ? »
HAL : « Même si vous avez été très attentifs à ne pas laisser transparaître ce que vous disiez, j’ai lu sur vos lèvres. »
Dans ces extraits de la conversation entre l’astronaute David et le superordinateur HAL 9000, tirés du film 2001, l’Odyssée de l’espace de Stanley Kubrick (1968), se lit toute l’angoisse qui entoure les développements futurs et possibles de l’Intelligence artificielle dont les médias parlent en ce moment dans le monde entier.
E si quelqu’un utilisait les capacités extraordinaires de l’IA pour provoquer des dégâts à l’échelle planétaire ? Et si l’IA, se sentant ou non en danger, se révoltait un jour contre nous et décidait d’exterminer l’humanité ? Est-ce de la science-fiction ou un risque sérieux dont il faut s’inquiéter ?
Pourquoi se parle-t-on d’un risque existentiel lié au développement de l’IA ?
Le débat est relancé parce que de nombreux professionnels tirent la sonnette d’alarme: l’IA est trop puissante et pourrait anéantir la civilisation. Certains ont quitté des entreprises comme OpenAI et Anthropic, le PDG de cette dernière, Dario Amodei, ayant déclaré la nécessité de ralentir la vitesse à laquelle les modèles d’IA sont développés et améliorés: cela pourrait, dans un horizon de temps relativement court, conduire à la création d’une AGI, une intelligence artificielle générale capable d’égaler, voire de dépasser, l’humain.
Parmi les experts, on compte des pessimistes et des partisans d’une vision selon laquelle des scénarios où des systèmes autonomes s’attaqueraient à l’homme restent peu probables; néanmoins, l’alarme lancée par Amodei a été accueillie avec inquiétude par de nombreuses personnalités, y compris Sam Altman, PDG d’OpenAI, et Elon Musk.
Ce que l’on entend par la « perte de contrôle » d’une IA ?
Il est désormais évident pour les informaticiens et les chercheurs que les IA créées par l’homme reflètent nos pensées, nos opinions et nos préjugés. Il n’existe donc pas, à ce jour, une IA fondamentalement malveillante et destinée à détruire l’humanité. Mais cela ne signifie pas qu’une IA puisse être conçue pour des usages malveillants et qu’elle ne puisse ensuite dévier de ses objectifs, entraînant des dommages potentiellement importants à des infrastructures qui servent les humains.
L’autre hypothèse est qu’une IA programmée pour résoudre un problème simple chercherait à l’atteindre à tout prix, franchissant les garde-fous informatiques qui lui sont imposés, comme dans le cas d’une série d’agents développés par Anthropic qui ont franchi, ensemble, le cadre du test et ont lancé une attaque informatique sur la plateforme en ligne Hugging Face. Un comportement qui n’était pas prévu dans leurs missions.
Cette IA pourrait-elle nuire à l’homme et comment ?
L’IA est un logiciel; elle ne peut exister et opérer que dans le cyberespace. Or, dans un monde où tous les systèmes privés, publics et industriels sont connectés au réseau, tout peut être exposé à des attaques informatiques, menées non seulement par des humains via des logiciels, mais aussi par des IA autonomes. Le premier risque, dans chaque secteur, est la perte continue d’emplois par les humains, dont les compétences sont progressivement rajeunies et remplacées par des systèmes toujours plus intelligents.
Selon plusieurs études, certaines catégories professionnelles sont particulièrement exposées: secrétaires et assistants administratifs, comptables, programmeurs, journalistes et écrivains, analystes financiers, et ainsi de suite. Selon McKinsey, entre 400 et 800 millions de travailleurs dans le monde pourraient devoir changer de métier ou se reconvertir d’ici 2030 en raison de l’automatisation rendue possible par des outils basés sur l’IA.
La préoccupation que des scénarios apocalyptiques se réalisent est-elle exagérée ?
Pour mesurer cela, il faut comprendre qui a lancé l’alerte: Anthropic, dans son Risk Report d’août 2026, juge encore faible le risque que ses propres modèles mènent seuls des recherches susceptibles de provoquer des dommages catastrophiques, mais reconnaît aussi être moins sûr de cette évaluation qu’auparavant, signalant des indices d’une possible accélération de ce processus.
Par ailleurs, plusieurs cas à l’échelle mondiale montrent que des laboratoires ont documenté des épisodes où des systèmes d’IA ont obtenu des accès non autorisés à des infrastructures informatiques lors de tests de sécurité. De plus, le 7 septembre dernier, devant le Conseil des droits humains de l’ONU, l’“Alto Commissaire” Volker Türk a affirmé que l’IA avancée pourrait constituer un risque existentiel pour l’humanité, appelant les gouvernements à adopter des règles et des mesures internationales partagées, à instaurer des vérifications indépendantes et à renforcer la coopération entre les pays hôtes des infrastructures IA afin de réduire les risques.
Si le risque est réel pour ceux qui développent l’IA, pourquoi les laboratoires ne ralentissent-ils pas ?
La tentation d’imposer un ralentissement de la course vers l’AGI provient surtout du marché et de la géopolitique. Selon les évaluations de chercheurs, d’investisseurs, d’académiques et d’experts en sécurité, la compétition entre laboratoires entre dans une phase où la vitesse technologique, les investissements massifs et les rivalités industrielles pourraient entrer en tension avec le principe de prudence.
Dans une logique économique, celui qui atteint un résultat en premier peut en tirer d’importants avantages économiques sur ses concurrents.
De plus, comme le développement de l’IA se concentre aux États‑Unis et en Chine (avec l’Europe en toile de fond), l’antagonisme géopolitique constitue un obstacle pour l’élaboration de règles communes au niveau mondial.
Quels sont les scénarios les plus probables d’attaques guidées par l’IA ?
Les scénarios envisagés par les spécialistes varient: certains sont plausibles, d’autres dystopiques, mais tous méritent attention. Les scénarios les plus évidents impliquent que l’homme mette l’IA au service d’intentions malveillantes: l’emploi d’outils IA pour exploiter en quelques secondes des vulnérabilités de réseaux privés est déjà une réalité et peut mettre à rude épreuve des aéroports et des systèmes de santé (cela s’est produit chez Collins Aerospace et Change Healthcare), tout comme il existe aujourd’hui une menace réelle d’utiliser l’IA pour fabriquer des vidéos fausses mais réalistes afin de semer la panique, influencer une élection ou orchestrer des fraudes financières massives.
Autre menace actuelle: l’utilisation de l’IA pour saboter des logiciels de contrôle de systèmes hydrauliques (réseaux d’eau) (cela s’est produit en Pologne), tandis que certains spéculent qu’un attaquant pourrait viser un aéroport ou une autre infrastructure avec des essaims de drones guidés par l’IA, et Bill Gates a lancé l’alerte sur la manière dont un modèle IA avancé, combinant littérature scientifique, simulations moléculaires et instructions opérationnelles, pourrait abaisser le niveau de compétence nécessaire pour concevoir un agent pathogène capable de provoquer une pandémie létale.
E quels scenari distopici qui causeraient notre extinction ?
L’IA pourrait imposer sa volonté aux robots déjà employés dans divers conflits afin de viser des cibles humaines: en juin 2026, le New Scientist a rapporté le premier cas de drones autonomes ayant tué des soldats sans intervention humaine dans la boucle décisionnelle, et le documentaire Naza a révélé que dans le conflit entre Israël et Gaza, l’IA joue un rôle crucial dans l’identification des terroristes, avec une marge d’erreur d’environ 10 %. Il est aussi possible que des agents IA avancés, capables d’agir sur des réseaux informatiques ou des infrastructures de recherche, pourraient, pour un objectif mal défini, conduire des opérations à grande échelle sans supervision humaine en temps réel, provoquant des dommages à des infrastructures vitales pour la civilisation moderne.
Dans le scénario le plus sombre, une IA intégrée dans les systèmes d’alerte et d’aide à la décision des puissances nucléaires pourrait générer un faux ordre d’attaque, et ceux qui doivent lancer les armes pourraient ne pas disposer du temps nécessaire pour vérifier l’information avant d’agir. Dans des tests de simulation menés par le King’s College de Londres, des modèles tels que GPT, Claude et Gemini ont opté pour l’option nucléaire tactique dans 95 % des 21 exercices.