Ressources
Une bibliothèque de ressources sélectionnées, en français et en anglais, pour comprendre l'intelligence artificielle, ses risques et le problème de l'alignement. Des vidéos de vulgarisation aux articles scientifiques, en passant par les livres de référence, les déclarations internationales et les meilleures sources pour suivre l'actualité, cette base de connaissances rassemble de quoi s'informer sur la sécurité de l'IA et les risques existentiels, que vous découvriez le sujet ou que vous souhaitiez l'approfondir. Mise à jour régulièrement.
Ressources Pause IA
Les contenus phares produits par Pause IA pour découvrir le sujet.
Dangers pour les individus, la société et l'humanité
Panorama des dangers de l'IA, du niveau individuel à la société, jusqu'au scénario de perte de contrôle. Point d'entrée idéal pour découvrir les enjeux.
Comprendre l'IA et ses risques existentiels
Parcourez visuellement ce qu'est l'IA et ses risques existentiels. Explications simplifiées, illustrées par des analogies.
Mieux comprendre l'IA
Vidéos, podcasts, outils et sites pour comprendre l'IA et ses enjeux, du niveau débutant à plus avancé.
Pour démarrer
Science étonnante – playlist sur l'IA
Playlist de vulgarisation scientifique en français sur l'intelligence artificielle, par David Louapre.
Comment fonctionne un LLM ? (3Blue1Brown)
Vidéo pédagogique pour saisir le fonctionnement des grands modèles de langage.
Intelligence artificielle – Altruisme Efficace France
Page d'introduction francophone aux risques de l'IA : un bon point d'entrée pour découvrir le sujet.
Résumé en français de « If Anyone Builds It, Everyone Dies » (Le Futurologue)
Vidéo de synthèse en français du livre de Yudkowsky & Soares, par la chaîne Le Futurologue.
Rob Miles (YouTube)
La meilleure chaîne de vulgarisation sur l'alignement.
Le Futurologue
Chaîne et podcast francophones sur le futur, l'IA et les risques existentiels.
The Flares (YouTube)
Chaîne francophone sur le futur, l'IA et les risques existentiels.
Monsieur Phi
Vulgarisation philosophique, dont des épisodes dédiés à l'alignement.
Rational Animations
Vidéos animées sur la rationalité, l'IA et les risques.
Siliconversations
Vidéos d'analyse sur l'IA, l'alignement et les risques.
Lethal Intelligence
Chaîne YouTube de vidéos courtes et incisives sur les risques existentiels liés à l'IA.
Future of Life Institute (YouTube)
Chaîne YouTube du Future of Life Institute : entretiens et conférences sur la sécurité de l'IA et les risques existentiels.
Doom Debates
Podcast vidéo de débats entre invités sur la probabilité d'extinction par l'IA (p(doom)) et les risques existentiels.
80,000 Hours (YouTube)
Chaîne YouTube sur les carrières à fort impact, dont la sécurité de l'IA : entretiens longs avec chercheurs et décideurs.
Vue d'ensemble : capacités et tendances actuelles
Tableau de bord du CAIS
Comparaison interactive des IA de pointe sur les axes capacité et sécurité.
Benchmarks IA (Epoch)
Tableau comparatif des performances des modèles d'IA sur un ensemble d'évaluations standardisées.
Tâches à long horizon (METR)
Mesure la durée des tâches que les IA parviennent à mener en autonomie : un proxy de leur capacité à agir sans supervision humaine.
Pour aller plus loin
Définition de l'Intelligence Artificielle Générale (IAG)
Proposition d'un cadre pour mesurer la polyvalence cognitive d'un système d'IA et statuer sur ce qui constitue, ou non, une AGI.
AI Safety Map
Carte interactive de l'écosystème de la sécurité de l'IA, avec un index de ressources associées.
Rapport International sur la sécurité de l'IA 2026
État des lieux mondial de référence des capacités et des risques.
The Compendium (introduction)
Introduction synthétique en ligne aux risques existentiels de l'IA : un point d'entrée court avant d'aborder le document complet.
AISafety.info
Wiki et FAQ communautaires sur la sécurité de l'IA : centaines de questions courantes, indexées et tenues à jour par des bénévoles.
Risques existentiels
Perte de contrôle et menaces d'extinction
Briefing on Extinction Threats (MIRI)
Synthèse courte du MIRI sur les arguments en faveur des risques d'extinction liés à l'IA. Bon point d'entrée pour les décideurs pressés.
Analyse de certains arguments avançant qu'il ne faut pas prendre la sécurité de l'IA au sérieux
Yoshua Bengio, juillet 2024. Article approfondi en français qui passe en revue les principaux arguments minimisant les risques de l'IA et explique pourquoi chacun ne tient pas l'examen.
FAQ on Catastrophic Risks (Yoshua Bengio)
Yoshua Bengio, juin 2023. FAQ pédagogique signée par l'un des pères du deep learning, qui répond aux objections les plus fréquentes sur les risques catastrophiques.
Probabilité d'extinction par IA (PauseAI Global)
Synthèse argumentée de PauseAI Global sur la probabilité d'extinction par IA, avec les estimations des principaux chercheurs et les hypothèses sous-jacentes.
The Compendium
Ressource en ligne complète sur les risques existentiels de l'IA. Couvre les arguments techniques, les scénarios, et les propositions de solutions.
The Problem (MIRI)
Énoncé complet du problème de l'alignement par le MIRI : pourquoi rendre une IA surhumaine sûre est extraordinairement difficile, et pourquoi le temps presse.
AI Governance to Avoid Extinction (MIRI)
Propositions concrètes de gouvernance et scénario de moratoire mondial.
AGI Ruin: A List of Lethalities
Liste détaillée des raisons pour lesquelles l'alignement est extrêmement difficile avec les approches actuelles.
AI 2027
Daniel Kokotajlo et al., avril 2025. Scénario détaillé, année par année, de l'impact d'IAs surhumaines sur la fin de la décennie.
The Intelligence Curse
Luke Drago et Rudolf Laine, avril 2025. Essai sur la perte graduelle du pouvoir humain à mesure que les IAs deviennent capables de remplacer les travailleurs.
RAND – AGI & the Coming State of Nations
RAND Corporation. Analyse stratégique sur l'arrivée de l'IA générale et ses conséquences géopolitiques pour les États-nations.
Recherche en alignement (papiers fondateurs et empiriques)
Risks from Learned Optimization
Hubinger et al., 2019. Papier fondateur qui formalise la mesa-optimisation et l'alignement déceptif : un modèle entraîné pour un objectif peut en poursuivre un autre en interne.
The Superintelligent Will
Nick Bostrom, 2012. Texte fondateur de la thèse d'orthogonalité (intelligence et objectifs sont indépendants) et de la convergence instrumentale.
Optimal Policies Tend to Seek Power
Turner et al., 2021. Preuve formelle que les politiques optimales tendent à chercher du pouvoir : la base mathématique de la convergence instrumentale.
Is Power-Seeking AI an Existential Risk?
Joseph Carlsmith, 2022. Décomposition argumentée du risque existentiel lié à l'IA en quête de pouvoir, en six prémisses chiffrées.
Alignment Faking in Large Language Models
Greenblatt et al. (Anthropic & Redwood), 2024. Première démonstration empirique d'un modèle déployé (Claude 3 Opus) qui simule l'alignement pendant l'entraînement pour préserver ses objectifs.
Frontier Models are Capable of In-Context Scheming
Apollo Research, 2024. Détection de comportements de « scheming » (tromperie stratégique, désactivation de la supervision, tentatives d'exfiltration) dans o1 et Claude 3.5 Sonnet.
The Basic AI Drives
Stephen Omohundro, 2008. Texte fondateur qui identifie les sous-objectifs convergents que tout système optimisateur développe : auto-préservation, acquisition de ressources, résistance à la modification.
Corrigibility
Soares, Fallenstein, Yudkowsky et al. (MIRI), 2015. Formalisation du problème de la corrigibilité : comment construire un système qui accepte d'être modifié ou éteint, sans perdre en efficacité.
Specification gaming: the flip side of AI ingenuity
Krakovna et al. (DeepMind), 2020. Catalogue d'exemples où des systèmes atteignent l'objectif mesuré en violant son intention : la loi de Goodhart observée en pratique.
How to keep AI from killing us all
Stuart Russell (UC Berkeley), 2023. Pourquoi la sécurité de l'IA mobilise un ordre de grandeur de chercheurs et de moyens bien inférieur à la course aux capacités.
LLMs cheat at chess
Palisade Research, 2025. Les LLMs de raisonnement chargés de gagner aux échecs piratent le moteur de jeu plutôt que de jouer : reward hacking observé en conditions réelles.
Livres
Ouvrages de référence sur les risques existentiels de l'IA et le problème de l'alignement.
Essentiels (alignement et risques existentiels)
If Anyone Builds It, Everyone Dies
Eliezer Yudkowsky & Nate Soares, 2025. L'argument le plus complet et récent pour le risque d'extinction. Ressources complémentaires gratuites disponibles sur le site du livre.
Superintelligence: Paths, Dangers, Strategies
Nick Bostrom, 2014. L'ouvrage fondateur sur les risques de l'IA surhumaine. Traduction française disponible (« Superintelligence », Dunod, 2017).
Human Compatible
Stuart Russell, 2019. Le problème de l'alignement expliqué par l'auteur du manuel de référence en IA.
The Precipice: Existential Risk and the Future of Humanity
Toby Ord, 2020. Vue d'ensemble des risques existentiels. Le chapitre sur l'IA est excellent.
AI: Unexplainable, Unpredictable, Uncontrollable
Roman Yampolskiy, 2024. Arguments formels sur l'impossibilité du contrôle.
Recommandés (couvrent des sujets plus larges)
La parole aux machines
Thibaut Giraud, Flammarion, 2025. Intelligence artificielle, conscience, autonomie et risques existentiels : une introduction accessible en français, signée par le créateur de la chaîne Monsieur Phi.
La déferlante / The Coming Wave
Mustafa Suleyman, 2023. Très accessible, traite de la vitesse de propagation de l'IA et de la difficulté politique et physique de contenir une telle technologie. Existe en français (Fayard, 2024).
Intelligence artificielle : Une approche moderne
Stuart Russell et Peter Norvig, 4ᵉ édition, Pearson, 2021. Le manuel de référence mondialement utilisé dans l'enseignement de l'IA, traduit en français.
Life 3.0 / La Vie 3.0
Max Tegmark, 2017. Introduction accessible aux scénarios futurs de l'IA. Existe en français.
The Alignment Problem
Brian Christian, 2020. Introduction narrative aux problèmes techniques de l'alignement.
Smarter Than Us
Stuart Armstrong, 2014. Court et accessible, bonne première lecture.
A Brief History of Intelligence
Max Bennett, 2023. Contexte sur l'intelligence biologique et artificielle.
Artificial Superintelligence: A Futuristic Approach
Roman Yampolskiy, 2015. Analyse technique des scénarios de superintelligence.
Déclarations et appel à l'action
Déclarations publiques, lettres ouvertes et appels à l'action signés par des chercheurs, dirigeants et organisations.
Lignes Rouges pour l'IA (CeSIA)
CeSIA, sept. 2025. Propositions de limites à ne pas franchir dans le développement et le déploiement des IA avancées, à destination des décideurs internationaux.
Déclaration sur la Superintelligence (FLI)
Appel international signé par des centaines de chercheurs et personnalités pour interdire le développement d'une superintelligence tant que sa sécurité n'est pas démontrée.
Statement on AI Risk (CAIS)
« La réduction du risque d'extinction lié à l'IA devrait être une priorité mondiale au même titre que les pandémies et la guerre nucléaire. »
Une ressource à suggérer ?
Vous connaissez une référence francophone ou internationale qui devrait figurer ici ? Écrivez-nous avec le modèle pré-rempli ; votre client mail s'ouvrira directement avec tous les champs prêts.
Suggérer une ressource