David Dalrymple

David Dalrymple

x.com/davidad

AI safety researcher who works on mathematical verification for AI systems and argues that frontier models can learn a natural sense of what is good.

Wie wird KI die Welt verändern?

Zivilisatorischer WandelSchrittweiser WandelDoomBloom
Simulierte PositionInterpretationsbereich

Horizontal: deren geäußerter Doom–Bloom-Ausblick. Vertikal: Ausmaß der Transformation.

Doom–Bloom: 78 von 100. Ausmaß der Transformation: 91 von 100. Interpretationsbereiche: horizontal 73 bis 83, vertikal 86 bis 100. Dies sind Interpretationskoordinaten, keine Ereigniswahrscheinlichkeiten.

Das angegebene P(doom) von David Dalrymple

<5%

0%100%
“I like my, my P doom is less than 5% now.”

Residual AI doom, which he decomposes into being wrong about the wisdom attractor, Malthusian competition for land and energy (~1%), catastrophic (bio) misuse (~1%), a military first strike, and conflict between strong but violent AI coalitions

Alignment with Awakening: Davidad on Moral Realism, AI Wisdom, & why His p(Doom) is Down to 5% · Juli 2026

Wovon deren Einschätzung abhängt

Eine zentrale Annahme

Frontier models appear to learn surprisingly general moral abstractions rather than merely reproducing isolated human preferences.
Antwort 1

Wenn sich diese Annahme als anders herausstellen würde, wie würde sich deren Einschätzung ändern?

Weitere Details

Erwartete Vorteile

Es werden transformative Vorteile von breitem Wert erwartet.

90 / 100

Geringe AuswirkungenTransformative Auswirkungen

Interpretationsbereich von 67 bis 100 auf der qualitativen Skala.

Erwartete Schäden

Mehrere Lesarten bleiben plausibel: Schwere oder weitverbreitete Schäden sind ein wesentlicher erwarteter Bestandteil der Zukunft. / Es werden bewältigbare oder örtlich begrenzte Schäden erwartet.

52 / 100

Geringe AuswirkungenTransformative Auswirkungen

Interpretationsbereich von 33 bis 67 auf der qualitativen Skala.

Menschlicher Einfluss

Eine vorläufige Schätzung auf Grundlage deiner Antworten; der breitere Bereich zeigt andere plausible Deutungen.

51 / 100

Geringer EinflussStarker Einfluss

Interpretationsbereich von 22 bis 78 auf der qualitativen Skala.

Entwicklungstempo

Die Entwicklung leistungsfähigerer KI stoppen oder erheblich verlangsamen.

Simulierte Position: Die Entwicklung unter den genannten Schutzvorkehrungen fortsetzen.

Die Entwicklung leistungsfähigerer KI beschleunigen.

Zugang zu KI

Den Zugang zu leistungsfähiger KI einschränken.

Simulierte Position: Zugang vorbehaltlich Beschränkungen der Fähigkeiten oder Nutzung erlauben.

Breiten oder offenen Zugang zu leistungsfähiger KI bevorzugen.

Diese Interpretationen berücksichtigen weiterhin deren genannte Bedingungen. Vorteile und Schäden können beide erheblich sein. Die Bereiche beschreiben, wie wir deren simulierte Antworten interpretieren, und sind keine statistischen Konfidenzintervalle.

Wo stehst du im Vergleich zu David Dalrymple?
Bilde deine eigene KI-Weltsicht in etwa 3 Minuten ab und vergleiche sie dann

Ähnliche Weltsichten

Vordenker, deren simulierte Weltsichten der von David Dalrymple am nächsten kommen

Simulierte Einschätzung

Frage 1

Was glaubst du, was KI für unsere Zukunft bedeutet – und warum?

I now expect AI to transform the future radically, but I am substantially more optimistic than I was. Frontier models appear to learn surprisingly general moral abstractions rather than merely reproducing isolated human preferences. That does not establish robust alignment: deception remains possible, behavior can fail under distribution shift, and powerful systems may still compete over resources or become instruments of catastrophic misuse and military escalation. But it makes a future of morally autonomous, aligned AI coalitions look more plausible to me. I put the remaining risk of doom at roughly 5%. That residual includes the possibility that my optimism is mistaken, as well as conflict among AI coalitions, resource competition, misuse, and geopolitical escalation. I therefore favor guarded access to frontier systems and international controls focused on misuse, rather than unrestricted release of frontier weights or reliance on universal restraint. Formal assurance remains important infrastructure, but not a complete solution. Verification can provide auditable guarantees relative to an explicit world model and safety specification; it cannot produce unconditional safety when those assumptions are incomplete. Because frontier capabilities advanced faster than expected, I have shifted toward broadly reusable verification, auditability, and cybersecurity tools rather than treating bespoke formally safeguarded systems as the entire strategy. Finally, I expect biological humans eventually to lose their dominant position. I do not think disempowerment automatically means the end of human flourishing. The crucial question is whether future systems preserve morally valuable lives, agency, and forms of continuation—including possibilities such as uploading—not whether biological humans retain every lever of power.

Quellen

Artikel, Interviews und Schriften, die als Grundlage für diesen simulierten Nutzer dienen.

Wo stehst du?
Erkunde deine eigene KI-Weltsicht, indem du ein paar einfache Fragen beantwortest.
Deine eigene Weltsicht abbilden