Pergunta 1
David Dalrymple
x.com/davidadAI safety researcher who works on mathematical verification for AI systems and argues that frontier models can learn a natural sense of what is good.
Como a IA mudará o mundo?
Na horizontal: a perspectiva Doom–Bloom expressa por essa pessoa. Para cima: escala da transformação.
Doom–Bloom: 78 de 100. Escala da transformação: 91 de 100. Intervalos de interpretação: 73 a 83 na horizontal, 86 a 100 na vertical. Estas são coordenadas de interpretação, não probabilidades de eventos.
<5%
“I like my, my P doom is less than 5% now.”
Residual AI doom, which he decomposes into being wrong about the wisdom attractor, Malthusian competition for land and energy (~1%), catastrophic (bio) misuse (~1%), a military first strike, and conflict between strong but violent AI coalitions
Alignment with Awakening: Davidad on Moral Realism, AI Wisdom, & why His p(Doom) is Down to 5% · jul. de 2026
Uma premissa central
Frontier models appear to learn surprisingly general moral abstractions rather than merely reproducing isolated human preferences.Resposta 1
Se essa premissa se revelasse diferente, como a perspectiva dessa pessoa mudaria?
Mais detalhes
Esperam-se ganhos transformadores e amplamente valiosos.
90 / 100
Intervalo de interpretação de 67 a 100 na escala qualitativa.
Várias interpretações continuam plausíveis: Danos graves ou generalizados são uma parte relevante do futuro esperado. / Esperam-se danos administráveis ou localizados.
52 / 100
Intervalo de interpretação de 33 a 67 na escala qualitativa.
Uma estimativa provisória com base nas suas respostas; o intervalo mais amplo mostra outras interpretações plausíveis.
51 / 100
Intervalo de interpretação de 22 a 78 na escala qualitativa.
Interromper ou desacelerar substancialmente o desenvolvimento de uma IA mais capaz.
Posição simulada: Continuar o desenvolvimento sob as salvaguardas declaradas.
Acelerar o desenvolvimento de uma IA mais capaz.
Restringir o acesso à IA poderosa.
Posição simulada: Permitir o acesso sujeito a restrições de capacidade ou de uso.
Favorecer o acesso amplo ou aberto à IA poderosa.
Estas interpretações mantêm as condições que essa pessoa declarou. Tanto os benefícios quanto os danos podem ser substanciais. Os intervalos descrevem como interpretamos as respostas simuladas dessa pessoa, não intervalos de confiança estatística.
Visões de mundo semelhantes
Líderes de opinião cujas visões de mundo simuladas são mais próximas da visão de David Dalrymple
Avaliação simulada
Fontes
Artigos, entrevistas e textos usados para fundamentar este usuário simulado.
Coauthored framework specifies world model, safety specification and verifier; outlines unresolved technical challenges.

Direct statement explains combining scientific models and proofs for stronger safety assurances.

2026 institutional update records a pivot toward assurance tooling and cybersecurity; do not present the original programme architecture as already achieved.

Explains that frontier capabilities outran programme expectations, motivating a pivot toward reusable verification and auditability tools rather than bespoke model development; highlights critical-infrastructure security.

Davidad explains his 2025–26 shift toward believing frontier models learn a natural moral abstraction; acknowledges deception persists and robustness is incomplete. Gabriel Alfour contests the thesis; his objections are not Davidad’s beliefs.

In the transcript, Dalrymple gives below 5% residual doom risk (later described as roughly 5%), favors aligned AI coalitions and moral autonomy, regards biological disempowerment as inevitable but not necessarily bad, and supports international misuse restrictions instead of hoping for universal slowdown.

Onde você se situa?
Mapear minha visão de mundo