Question 1
David Dalrymple
x.com/davidadAI safety researcher who works on mathematical verification for AI systems and argues that frontier models can learn a natural sense of what is good.
Comment l’IA changera-t-elle le monde ?
Horizontalement : leur perspective Doom–Bloom telle qu’elle a été exprimée. Verticalement : ampleur de la transformation.
Doom–Bloom : 78 sur 100. Ampleur de la transformation : 91 sur 100. Plages d’interprétation : de 73 à 83 horizontalement, de 86 à 100 verticalement. Il s’agit de coordonnées d’interprétation, et non de probabilités d’événements.
<5%
“I like my, my P doom is less than 5% now.”
Residual AI doom, which he decomposes into being wrong about the wisdom attractor, Malthusian competition for land and energy (~1%), catastrophic (bio) misuse (~1%), a military first strike, and conflict between strong but violent AI coalitions
Alignment with Awakening: Davidad on Moral Realism, AI Wisdom, & why His p(Doom) is Down to 5% · juil. 2026
Une hypothèse centrale
Frontier models appear to learn surprisingly general moral abstractions rather than merely reproducing isolated human preferences.Réponse 1
Si cette hypothèse s’avérait différente, comment leur perspective changerait-elle ?
Plus de détails
Des bénéfices transformateurs et largement profitables sont attendus.
90 / 100
Plage d’interprétation de 67 à 100 sur l’échelle qualitative.
Plusieurs interprétations restent plausibles : Des dommages graves ou généralisés constituent une composante substantielle de l’avenir attendu. / Des dommages gérables ou localisés sont attendus.
52 / 100
Plage d’interprétation de 33 à 67 sur l’échelle qualitative.
Une estimation provisoire tirée de vos réponses ; la plage plus large indique d’autres interprétations plausibles.
51 / 100
Plage d’interprétation de 22 à 78 sur l’échelle qualitative.
Arrêter ou ralentir considérablement le développement d’IA plus performantes.
Position simulée : Poursuivre le développement dans le cadre des mesures de protection annoncées.
Accélérer le développement d’IA plus performantes.
Restreindre l’accès aux IA puissantes.
Position simulée : Autoriser l’accès sous réserve de restrictions liées aux capacités ou aux usages.
Privilégier un accès large ou ouvert aux IA puissantes.
Ces interprétations conservent les conditions énoncées. Les bénéfices et les dommages peuvent tous deux être substantiels. Les plages décrivent notre lecture de leurs réponses simulées, et non des intervalles de confiance statistiques.
Visions du monde similaires
Leaders d’opinion dont les visions du monde simulées sont les plus proches de celle de David Dalrymple
Évaluation simulée
Sources
Articles, entretiens et écrits utilisés pour ancrer cet utilisateur simulé dans les faits.
Coauthored framework specifies world model, safety specification and verifier; outlines unresolved technical challenges.

Direct statement explains combining scientific models and proofs for stronger safety assurances.

2026 institutional update records a pivot toward assurance tooling and cybersecurity; do not present the original programme architecture as already achieved.

Explains that frontier capabilities outran programme expectations, motivating a pivot toward reusable verification and auditability tools rather than bespoke model development; highlights critical-infrastructure security.

Davidad explains his 2025–26 shift toward believing frontier models learn a natural moral abstraction; acknowledges deception persists and robustness is incomplete. Gabriel Alfour contests the thesis; his objections are not Davidad’s beliefs.

In the transcript, Dalrymple gives below 5% residual doom risk (later described as roughly 5%), favors aligned AI coalitions and moral autonomy, regards biological disempowerment as inevitable but not necessarily bad, and supports international misuse restrictions instead of hoping for universal slowdown.

Où vous situez-vous ?
Cartographier ma vision du monde