Risques de l'IA : de la fin du monde annoncée aux attaques déjà là

Où en est-on, et qu'est-ce qui bloque encore ?

État au

On vous donne des probabilités de catastrophe. Elles ne s'accordent pas, et aucune ne peut être vérifiée. Pendant ce temps, les attaques réelles menées avec l'aide de l'IA — intrusions, espionnage — ont déjà commencé.

Ce qu'on vous annonce

La probabilité que l'IA provoque une catastrophe, selon ceux qui s'expriment :

5 à 10 %Enquête auprès de 2 778 chercheurs en IA : la médiane varie selon la question posée (Grace et al., 2023)
10 à 20 %Geoffrey Hinton, pionnier de l'IA : extinction de l'humanité d'ici trente ans (BBC Radio 4, rapporté par The Guardian, décembre 2024)
25 %Dario Amodei, dirigeant d'Anthropic : « que les choses tournent vraiment très mal » (Axios, septembre 2025)
99,9 %Roman Yampolskiy, chercheur : estimation conditionnelle, si une superintelligence est construite, sur cent ans (Lex Fridman Podcast, juin 2024)

De 5 à 99,9 % : ils ne répondent pas à la même question. Et aucun ne peut être vérifié : une probabilité se calcule à partir de ce qu'on a observé, et ces chiffres portent sur un évènement qui ne s'est jamais produit.

Ce que nous faisons à la place

Une méthode. Pas de boule de cristal, pas d'horloge de la fin du monde : une évaluation des risques fondée sur ce qui a déjà été observé.

Nous prenons les attaques que l'on redoute, décrites par ceux qui les étudient. Pour chacune, nous établissons ce qui a déjà été vu, et à quelle date. Puis nous nommons la défense qui tient encore, et qui peut la lever.

Nous ne prédisons rien. Nous comptons ce qui a déjà été démontré.

Pourquoi ça vous concerne

Votre défense ne vous appartient pas. Ce qui vous protège aujourd'hui est tenu par d'autres, fournisseurs, laboratoires, évaluateurs, et personne ne vous prévient quand ça cède.

Un exemple, tiré de notre liste

Entre décembre 2025 et août 2026, des opérations d'intrusion et d'espionnage menées avec l'aide d'un modèle d'IA ont été détectées, puis coupées : le fournisseur du modèle a repéré les comptes et les a fermés.

La défense
La fermeture des comptes par le fournisseur du modèle.
Qui la tient
Les fournisseurs de modèles eux-mêmes.
Ce qui la ferait céder
Une opération de même ampleur menée jusqu'au bout sans être détectée.
Source
le rapport du fournisseur concerné, septembre 2026. C'est le seul à pouvoir observer cette défense : nous le signalons.

Trois faits

  1. Les modèles d'IA réussissent des tâches informatiques de plus en plus difficiles — précisément le terrain des intrusions. Mesurée en temps de travail d'un expert humain, la difficulté des tâches informatiques qu'ils réussissent double tous les trois mois environ depuis 2024, contre sept mois en moyenne depuis 2019. Mesure indépendante de METR, janvier 2026.
  2. Ce qui bloquait en mars ne bloquait plus en mai. Quatre limites des modèles, relevées en mars par l'institut britannique de sécurité de l'IA, étaient franchies en mai. Ce sont quatre observations, pas une loi générale : c'est pourquoi notre liste est datée.
  3. Le passage au réel est l'étape qui résiste. Une technique d'attaque est d'abord démontrée en laboratoire, puis observée dans le réel. Trois sur quatre franchissent la première étape, une sur trois seulement la seconde — dans le catalogue de référence du domaine, qui recense ce qui a été documenté.
Dans le catalogue de référence du domaine, qui recense ce qui a été documenté : trois techniques d'attaque sur quatre passent de l'idée à la démonstration en laboratoire, en huit mois environ, entre six et onze mois ; une sur trois seulement passe ensuite au réel, en cinquante-cinq mois environ, sans limite haute connue.
Le parcours détaillé, avec tous les effectifs, est dans l'article.

Ce qui est nouveau

D'autres travaux font une partie de ce chemin. Aucun ne réunit les trois.

TravailScénario redouté, décrit par des expertsÉtapes datées par des faits réelsDéfense restante nommée
SaferAIouinonnon
Anthropicnonouinon
CLTRnonouinon
Future of Life Instituteouinonnon
Google DeepMindouinonnon
AI-RISKPATHouiouioui

Nos dates sont celles où les faits ont été documentés, pas toujours celles où ils se sont produits.

Les deux cadres de référence le disent eux-mêmes : ils modélisent l'avenir, faute de données ou par choix. Nous partons de ce qui a déjà eu lieu.

PLACEHOLDER — liens actifs le jour de la publication.