Ce qu'on vous annonce
La probabilité que l'IA provoque une catastrophe, selon ceux qui s'expriment :
| 5 à 10 % | Enquête auprès de 2 778 chercheurs en IA : la médiane varie selon la question posée (Grace et al., 2023) |
| 10 à 20 % | Geoffrey Hinton, pionnier de l'IA : extinction de l'humanité d'ici trente ans (BBC Radio 4, rapporté par The Guardian, décembre 2024) |
| 25 % | Dario Amodei, dirigeant d'Anthropic : « que les choses tournent vraiment très mal », pour 75 % de chances que tout se passe très bien (Axios, septembre 2025) |
| 99,9 % | Roman Yampolskiy, chercheur : estimation conditionnelle, si une superintelligence est construite, sur cent ans (Lex Fridman Podcast, juin 2024) |
De 5 à 99,9 % : ils ne répondent pas à la même question. Et aucun ne peut être vérifié : une probabilité se calcule à partir de ce qu'on a observé, et ces chiffres portent sur un évènement qui ne s'est jamais produit.
Ce que nous faisons à la place
Une méthode. Pas de boule de cristal, pas d'horloge de la fin du monde : une évaluation des risques fondée sur ce qui a déjà été observé.
Nous prenons les attaques que l'on redoute, décrites par ceux qui les étudient. Pour chacune, nous établissons ce qui a déjà été vu, et à quelle date. Puis nous nommons la défense qui tient encore, et qui peut la lever.
Nous ne prédisons rien. Nous comptons ce qui a déjà été démontré.
Pourquoi ça vous concerne
Votre défense ne vous appartient pas. Ce qui vous protège aujourd'hui est tenu par d'autres, fournisseurs, laboratoires, évaluateurs, et personne ne vous prévient quand ça cède.
Un exemple, tiré de notre liste
Entre décembre 2025 et août 2026, des opérations d'intrusion et d'espionnage menées avec l'aide d'un modèle d'IA ont été détectées, puis coupées : le fournisseur du modèle a repéré les comptes et les a fermés.
- La défense
- La fermeture des comptes par le fournisseur du modèle.
- Qui la tient
- Les fournisseurs de modèles eux-mêmes.
- Ce qui la ferait céder
- Une opération de même ampleur menée jusqu'au bout sans être détectée.
- Source
- le rapport du fournisseur concerné, septembre 2026. C'est le seul à pouvoir observer cette défense : nous le signalons.
Trois faits
- Les modèles d'IA réussissent des tâches informatiques de plus en plus difficiles — précisément le terrain des intrusions. Mesurée en temps de travail d'un expert humain, la difficulté des tâches informatiques qu'ils réussissent double tous les trois mois environ depuis 2024, contre sept mois en moyenne depuis 2019. Mesure indépendante de METR, janvier 2026.
- Ce qui bloquait en mars ne bloquait plus en mai. Quatre limites des modèles, relevées en mars par l'institut britannique de sécurité de l'IA, étaient franchies en mai. Ce sont quatre observations, pas une loi générale : c'est pourquoi notre liste est datée.
- Le passage au réel est l'étape qui résiste. Une technique d'attaque est d'abord démontrée en laboratoire, puis observée dans le réel. Trois sur quatre franchissent la première étape, une sur trois seulement la seconde — dans le catalogue de référence du domaine, qui recense ce qui a été documenté.
Ce qui est nouveau
D'autres travaux font une partie de ce chemin. Aucun ne réunit les trois.
| Travail | Scénario redouté, décrit par des experts | Étapes datées par des faits réels | Défense restante nommée |
|---|---|---|---|
| SaferAI | oui | non | non |
| Anthropic | non | oui | non |
| CLTR | non | oui | non |
| Future of Life Institute | oui | non | non |
| Google DeepMind | oui | non | non |
| AI-RISKPATH | oui | oui | oui |
Nos dates sont celles où les faits ont été documentés, pas toujours celles où ils se sont produits.
Les deux cadres de référence le disent eux-mêmes : ils modélisent l'avenir, faute de données ou par choix. Nous partons de ce qui a déjà eu lieu.