David Dalrymple

David Dalrymple

x.com/davidad

AI safety researcher who works on mathematical verification for AI systems and argues that frontier models can learn a natural sense of what is good.

¿Cómo cambiará la IA el mundo?

Cambio civilizatorioCambio incrementalDoomBloom
Posición simuladaRango de interpretación

Horizontal: su perspectiva Doom–Bloom expresada. Vertical: escala de la transformación.

Doom–Bloom: 78 de 100. Escala de la transformación: 91 de 100. Rangos de interpretación: de 73 a 83 en horizontal y de 86 a 100 en vertical. Son coordenadas de interpretación, no probabilidades de eventos.

P(doom) declarado de David Dalrymple

<5%

0%100%
“I like my, my P doom is less than 5% now.”

Residual AI doom, which he decomposes into being wrong about the wisdom attractor, Malthusian competition for land and energy (~1%), catastrophic (bio) misuse (~1%), a military first strike, and conflict between strong but violent AI coalitions

Alignment with Awakening: Davidad on Moral Realism, AI Wisdom, & why His p(Doom) is Down to 5% · jul 2026

De qué depende su perspectiva

Un supuesto central

Frontier models appear to learn surprisingly general moral abstractions rather than merely reproducing isolated human preferences.
Respuesta 1

Si este supuesto resultara distinto, ¿cómo cambiaría su perspectiva?

Más detalles

Beneficio esperado

Se esperan beneficios transformadores y de gran valor para muchos.

90 / 100

Poco impactoImpacto transformador

Rango de interpretación de 67 a 100 en la escala cualitativa.

Daño esperado

Varias lecturas siguen siendo plausibles: Se espera que los daños graves o generalizados sean una parte significativa del futuro. / Se esperan daños manejables o localizados.

52 / 100

Poco impactoImpacto transformador

Rango de interpretación de 33 a 67 en la escala cualitativa.

Influencia humana

Una estimación provisional a partir de tus respuestas; el rango más amplio muestra otras lecturas plausibles.

51 / 100

Poca influenciaInfluencia fuerte

Rango de interpretación de 22 a 78 en la escala cualitativa.

Ritmo de desarrollo

Detener o frenar considerablemente el desarrollo de IA más capaz.

Posición simulada: Continuar el desarrollo con las salvaguardas indicadas.

Acelerar el desarrollo de IA más capaz.

Acceso a la IA

Restringir el acceso a la IA potente.

Posición simulada: Permitir el acceso con restricciones de capacidad o de uso.

Favorecer un acceso amplio o abierto a la IA potente.

Estas interpretaciones conservan las condiciones que se indicaron. Los beneficios y los daños pueden ser considerables a la vez. Los rangos describen cómo leemos sus respuestas simuladas, no intervalos de confianza estadísticos.

¿Dónde te ubicas frente a David Dalrymple?
Mapea tu propia visión de la IA en unos 3 minutos y luego compárala

Visiones similares

Líderes de opinión cuyas visiones simuladas son las más cercanas a la de David Dalrymple

Evaluación simulada

Pregunta 1

¿Qué crees que significa la IA para nuestro futuro y por qué?

I now expect AI to transform the future radically, but I am substantially more optimistic than I was. Frontier models appear to learn surprisingly general moral abstractions rather than merely reproducing isolated human preferences. That does not establish robust alignment: deception remains possible, behavior can fail under distribution shift, and powerful systems may still compete over resources or become instruments of catastrophic misuse and military escalation. But it makes a future of morally autonomous, aligned AI coalitions look more plausible to me. I put the remaining risk of doom at roughly 5%. That residual includes the possibility that my optimism is mistaken, as well as conflict among AI coalitions, resource competition, misuse, and geopolitical escalation. I therefore favor guarded access to frontier systems and international controls focused on misuse, rather than unrestricted release of frontier weights or reliance on universal restraint. Formal assurance remains important infrastructure, but not a complete solution. Verification can provide auditable guarantees relative to an explicit world model and safety specification; it cannot produce unconditional safety when those assumptions are incomplete. Because frontier capabilities advanced faster than expected, I have shifted toward broadly reusable verification, auditability, and cybersecurity tools rather than treating bespoke formally safeguarded systems as the entire strategy. Finally, I expect biological humans eventually to lose their dominant position. I do not think disempowerment automatically means the end of human flourishing. The crucial question is whether future systems preserve morally valuable lives, agency, and forms of continuation—including possibilities such as uploading—not whether biological humans retain every lever of power.

Fuentes

Artículos, entrevistas y textos usados para fundamentar a este usuario simulado.

¿Dónde te ubicas?
Explora tu propia visión de la IA respondiendo unas pocas preguntas sencillas.
Mapea tu propia visión de la IA

¿Dónde te ubicas?

Mapear mi visión de la IA