David Dalrymple

David Dalrymple

x.com/davidad

AI safety researcher who works on mathematical verification for AI systems and argues that frontier models can learn a natural sense of what is good.

Bagaimana AI akan mengubah dunia?

Perubahan peradabanPerubahan bertahapDoomBloom
Posisi simulasiRentang interpretasi

Mendatar: pandangan Doom–Bloom yang mereka ungkapkan. Ke atas: skala transformasi.

Doom–Bloom: 78 dari 100. Skala transformasi: 91 dari 100. Rentang interpretasi: 73 hingga 83 secara horizontal, 86 hingga 100 secara vertikal. Ini adalah koordinat interpretasi, bukan probabilitas kejadian.

P(doom) yang dinyatakan David Dalrymple

<5%

0%100%
“I like my, my P doom is less than 5% now.”

Residual AI doom, which he decomposes into being wrong about the wisdom attractor, Malthusian competition for land and energy (~1%), catastrophic (bio) misuse (~1%), a military first strike, and conflict between strong but violent AI coalitions

Alignment with Awakening: Davidad on Moral Realism, AI Wisdom, & why His p(Doom) is Down to 5% · Jul 2026

Hal-hal yang menentukan pandangan mereka

Asumsi utama

Frontier models appear to learn surprisingly general moral abstractions rather than merely reproducing isolated human preferences.
Jawaban 1

Jika asumsi ini ternyata berbeda, bagaimana pandangan mereka akan berubah?

Detail lebih lanjut

Manfaat yang diperkirakan

Manfaat transformatif yang bernilai luas diperkirakan akan terwujud.

90 / 100

Dampak kecilDampak transformatif

Rentang interpretasi 67 hingga 100 pada skala kualitatif.

Kerugian yang diperkirakan

Beberapa penafsiran masih mungkin: Kerugian parah atau meluas merupakan bagian yang berarti dari masa depan yang diperkirakan. / Kerugian yang dapat dikelola atau bersifat lokal diperkirakan akan terjadi.

52 / 100

Dampak kecilDampak transformatif

Rentang interpretasi 33 hingga 67 pada skala kualitatif.

Pengaruh manusia

Estimasi sementara dari jawaban Anda; rentang yang lebih lebar menunjukkan penafsiran lain yang masuk akal.

51 / 100

Sedikit pengaruhPengaruh kuat

Rentang interpretasi 22 hingga 78 pada skala kualitatif.

Laju pengembangan

Hentikan atau perlambat secara signifikan pengembangan AI yang lebih mampu.

Posisi simulasi: Lanjutkan pengembangan dengan perlindungan yang telah ditetapkan.

Percepat pengembangan AI yang lebih mampu.

Akses ke AI

Batasi akses ke AI yang berkemampuan tinggi.

Posisi simulasi: Izinkan akses dengan tunduk pada pembatasan kemampuan atau penggunaan.

Utamakan akses yang luas atau terbuka ke AI yang berkemampuan tinggi.

Interpretasi ini mempertahankan kondisi yang mereka nyatakan. Manfaat dan kerugian dapat sama-sama besar. Rentang tersebut menggambarkan cara kami membaca jawaban simulasi mereka, bukan interval kepercayaan statistik.

Di mana posisi Anda dibandingkan dengan David Dalrymple?
Petakan pandangan dunia AI Anda sendiri dalam waktu sekitar 3 menit, lalu bandingkan

Pandangan dunia serupa

Pemimpin opini dengan pandangan dunia simulasi yang paling mendekati pandangan David Dalrymple

Penilaian Simulasi

Pertanyaan 1

Menurut Anda, apa arti AI bagi masa depan kita—dan mengapa?

I now expect AI to transform the future radically, but I am substantially more optimistic than I was. Frontier models appear to learn surprisingly general moral abstractions rather than merely reproducing isolated human preferences. That does not establish robust alignment: deception remains possible, behavior can fail under distribution shift, and powerful systems may still compete over resources or become instruments of catastrophic misuse and military escalation. But it makes a future of morally autonomous, aligned AI coalitions look more plausible to me. I put the remaining risk of doom at roughly 5%. That residual includes the possibility that my optimism is mistaken, as well as conflict among AI coalitions, resource competition, misuse, and geopolitical escalation. I therefore favor guarded access to frontier systems and international controls focused on misuse, rather than unrestricted release of frontier weights or reliance on universal restraint. Formal assurance remains important infrastructure, but not a complete solution. Verification can provide auditable guarantees relative to an explicit world model and safety specification; it cannot produce unconditional safety when those assumptions are incomplete. Because frontier capabilities advanced faster than expected, I have shifted toward broadly reusable verification, auditability, and cybersecurity tools rather than treating bespoke formally safeguarded systems as the entire strategy. Finally, I expect biological humans eventually to lose their dominant position. I do not think disempowerment automatically means the end of human flourishing. The crucial question is whether future systems preserve morally valuable lives, agency, and forms of continuation—including possibilities such as uploading—not whether biological humans retain every lever of power.

Sumber

Artikel, wawancara, dan tulisan yang digunakan sebagai landasan bagi pengguna simulasi ini.

Di mana posisi Anda?
Jelajahi pandangan dunia AI Anda sendiri dengan menjawab beberapa pertanyaan sederhana.
Petakan pandangan dunia Anda sendiri

Di mana posisi Anda?

Petakan pandangan dunia saya