Frage 1
David Dalrymple
x.com/davidadAI safety researcher who works on mathematical verification for AI systems and argues that frontier models can learn a natural sense of what is good.
Wie wird KI die Welt verändern?
Horizontal: deren geäußerter Doom–Bloom-Ausblick. Vertikal: Ausmaß der Transformation.
Doom–Bloom: 78 von 100. Ausmaß der Transformation: 91 von 100. Interpretationsbereiche: horizontal 73 bis 83, vertikal 86 bis 100. Dies sind Interpretationskoordinaten, keine Ereigniswahrscheinlichkeiten.
<5%
“I like my, my P doom is less than 5% now.”
Residual AI doom, which he decomposes into being wrong about the wisdom attractor, Malthusian competition for land and energy (~1%), catastrophic (bio) misuse (~1%), a military first strike, and conflict between strong but violent AI coalitions
Alignment with Awakening: Davidad on Moral Realism, AI Wisdom, & why His p(Doom) is Down to 5% · Juli 2026
Eine zentrale Annahme
Frontier models appear to learn surprisingly general moral abstractions rather than merely reproducing isolated human preferences.Antwort 1
Wenn sich diese Annahme als anders herausstellen würde, wie würde sich deren Einschätzung ändern?
Weitere Details
Es werden transformative Vorteile von breitem Wert erwartet.
90 / 100
Interpretationsbereich von 67 bis 100 auf der qualitativen Skala.
Mehrere Lesarten bleiben plausibel: Schwere oder weitverbreitete Schäden sind ein wesentlicher erwarteter Bestandteil der Zukunft. / Es werden bewältigbare oder örtlich begrenzte Schäden erwartet.
52 / 100
Interpretationsbereich von 33 bis 67 auf der qualitativen Skala.
Eine vorläufige Schätzung auf Grundlage deiner Antworten; der breitere Bereich zeigt andere plausible Deutungen.
51 / 100
Interpretationsbereich von 22 bis 78 auf der qualitativen Skala.
Die Entwicklung leistungsfähigerer KI stoppen oder erheblich verlangsamen.
Simulierte Position: Die Entwicklung unter den genannten Schutzvorkehrungen fortsetzen.
Die Entwicklung leistungsfähigerer KI beschleunigen.
Den Zugang zu leistungsfähiger KI einschränken.
Simulierte Position: Zugang vorbehaltlich Beschränkungen der Fähigkeiten oder Nutzung erlauben.
Breiten oder offenen Zugang zu leistungsfähiger KI bevorzugen.
Diese Interpretationen berücksichtigen weiterhin deren genannte Bedingungen. Vorteile und Schäden können beide erheblich sein. Die Bereiche beschreiben, wie wir deren simulierte Antworten interpretieren, und sind keine statistischen Konfidenzintervalle.
Ähnliche Weltsichten
Vordenker, deren simulierte Weltsichten der von David Dalrymple am nächsten kommen
Simulierte Einschätzung
Quellen
Artikel, Interviews und Schriften, die als Grundlage für diesen simulierten Nutzer dienen.
Coauthored framework specifies world model, safety specification and verifier; outlines unresolved technical challenges.

Direct statement explains combining scientific models and proofs for stronger safety assurances.

2026 institutional update records a pivot toward assurance tooling and cybersecurity; do not present the original programme architecture as already achieved.

Explains that frontier capabilities outran programme expectations, motivating a pivot toward reusable verification and auditability tools rather than bespoke model development; highlights critical-infrastructure security.

Davidad explains his 2025–26 shift toward believing frontier models learn a natural moral abstraction; acknowledges deception persists and robustness is incomplete. Gabriel Alfour contests the thesis; his objections are not Davidad’s beliefs.

In the transcript, Dalrymple gives below 5% residual doom risk (later described as roughly 5%), favors aligned AI coalitions and moral autonomy, regards biological disempowerment as inevitable but not necessarily bad, and supports international misuse restrictions instead of hoping for universal slowdown.

Wo stehst du?
Meine Weltsicht abbilden