David Dalrymple

David Dalrymple

x.com/davidad

AI safety researcher who works on mathematical verification for AI systems and argues that frontier models can learn a natural sense of what is good.

Como a IA mudará o mundo?

Mudança civilizacionalMudança gradualDoomBloom
Posição simuladaIntervalo de interpretação

Na horizontal: a perspectiva Doom–Bloom expressa por essa pessoa. Para cima: escala da transformação.

Doom–Bloom: 78 de 100. Escala da transformação: 91 de 100. Intervalos de interpretação: 73 a 83 na horizontal, 86 a 100 na vertical. Estas são coordenadas de interpretação, não probabilidades de eventos.

P(doom) declarado de David Dalrymple

<5%

0%100%
“I like my, my P doom is less than 5% now.”

Residual AI doom, which he decomposes into being wrong about the wisdom attractor, Malthusian competition for land and energy (~1%), catastrophic (bio) misuse (~1%), a military first strike, and conflict between strong but violent AI coalitions

Alignment with Awakening: Davidad on Moral Realism, AI Wisdom, & why His p(Doom) is Down to 5% · jul. de 2026

Do que a perspectiva dessa pessoa depende

Uma premissa central

Frontier models appear to learn surprisingly general moral abstractions rather than merely reproducing isolated human preferences.
Resposta 1

Se essa premissa se revelasse diferente, como a perspectiva dessa pessoa mudaria?

Mais detalhes

Benefícios esperados

Esperam-se ganhos transformadores e amplamente valiosos.

90 / 100

Pouco impactoImpacto transformador

Intervalo de interpretação de 67 a 100 na escala qualitativa.

Danos esperados

Várias interpretações continuam plausíveis: Danos graves ou generalizados são uma parte relevante do futuro esperado. / Esperam-se danos administráveis ou localizados.

52 / 100

Pouco impactoImpacto transformador

Intervalo de interpretação de 33 a 67 na escala qualitativa.

Influência humana

Uma estimativa provisória com base nas suas respostas; o intervalo mais amplo mostra outras interpretações plausíveis.

51 / 100

Pouca influênciaForte influência

Intervalo de interpretação de 22 a 78 na escala qualitativa.

Ritmo de desenvolvimento

Interromper ou desacelerar substancialmente o desenvolvimento de uma IA mais capaz.

Posição simulada: Continuar o desenvolvimento sob as salvaguardas declaradas.

Acelerar o desenvolvimento de uma IA mais capaz.

Acesso à IA

Restringir o acesso à IA poderosa.

Posição simulada: Permitir o acesso sujeito a restrições de capacidade ou de uso.

Favorecer o acesso amplo ou aberto à IA poderosa.

Estas interpretações mantêm as condições que essa pessoa declarou. Tanto os benefícios quanto os danos podem ser substanciais. Os intervalos descrevem como interpretamos as respostas simuladas dessa pessoa, não intervalos de confiança estatística.

Onde você se situa em relação a David Dalrymple?
Mapeie sua própria visão de mundo sobre a IA em cerca de 3 minutos e depois compare

Visões de mundo semelhantes

Líderes de opinião cujas visões de mundo simuladas são mais próximas da visão de David Dalrymple

Avaliação simulada

Pergunta 1

O que você acha que a IA significa para o nosso futuro — e por quê?

I now expect AI to transform the future radically, but I am substantially more optimistic than I was. Frontier models appear to learn surprisingly general moral abstractions rather than merely reproducing isolated human preferences. That does not establish robust alignment: deception remains possible, behavior can fail under distribution shift, and powerful systems may still compete over resources or become instruments of catastrophic misuse and military escalation. But it makes a future of morally autonomous, aligned AI coalitions look more plausible to me. I put the remaining risk of doom at roughly 5%. That residual includes the possibility that my optimism is mistaken, as well as conflict among AI coalitions, resource competition, misuse, and geopolitical escalation. I therefore favor guarded access to frontier systems and international controls focused on misuse, rather than unrestricted release of frontier weights or reliance on universal restraint. Formal assurance remains important infrastructure, but not a complete solution. Verification can provide auditable guarantees relative to an explicit world model and safety specification; it cannot produce unconditional safety when those assumptions are incomplete. Because frontier capabilities advanced faster than expected, I have shifted toward broadly reusable verification, auditability, and cybersecurity tools rather than treating bespoke formally safeguarded systems as the entire strategy. Finally, I expect biological humans eventually to lose their dominant position. I do not think disempowerment automatically means the end of human flourishing. The crucial question is whether future systems preserve morally valuable lives, agency, and forms of continuation—including possibilities such as uploading—not whether biological humans retain every lever of power.

Fontes

Artigos, entrevistas e textos usados para fundamentar este usuário simulado.

Onde você se situa?
Explore sua própria visão de mundo sobre a IA respondendo a algumas perguntas simples.
Mapeie sua própria visão de mundo

Onde você se situa?

Mapear minha visão de mundo