Pseudonymous account that runs public experiments on AI refusals, censorship and watermarks and calls for transparency from frontier labs.

Como a IA mudará o mundo?

Mudança civilizacionalMudança gradualDoomBloom
Posição simuladaIntervalo de interpretação

Na horizontal: a perspectiva Doom–Bloom expressa por essa pessoa. Para cima: escala da transformação.

Doom–Bloom: 71 de 100. Escala da transformação: 56 de 100. Intervalos de interpretação: 66 a 76 na horizontal, 46 a 79 na vertical. Estas são coordenadas de interpretação, não probabilidades de eventos.

P(doom) de xlr8harder · inferido

≈6%

0%100%

Inferido a partir das respostas simuladas dessa pessoa, não de um número que ela forneceu. Intervalo plausível: 3–14%.

Do que a perspectiva dessa pessoa depende

Uma premissa central

But that expectation depends on institutions not turning safety into opaque control.
Resposta 2

Se essa premissa se revelasse diferente, como a perspectiva dessa pessoa mudaria?

Uma questão não resolvida

I would not attach a numerical forecast: too much depends on deployment choices, security practices, and governance.
Resposta 2

O que ajudaria essa pessoa a distinguir os resultados plausíveis aqui?

O que poderia mudar essa opinião

I would update toward pessimism if repeated, independent audits showed that powerful systems consistently evade oversight, conceal relevant behavior, or defeat containment under realistic conditions—not merely in contrived demonstrations—and if ordinary security improvements failed to reduce those problems.
Resposta 3

Que evidência seria suficiente e em que direção ela mudaria a visão dessa pessoa?

Mais detalhes

Benefícios esperados

Esperam-se benefícios substanciais, com condições importantes ou limites de distribuição.

74 / 100

Pouco impactoImpacto transformador

Intervalo de interpretação de 67 a 100 na escala qualitativa.

Danos esperados

Esperam-se danos administráveis ou localizados.

31 / 100

Pouco impactoImpacto transformador

Intervalo de interpretação de 0 a 33 na escala qualitativa.

Influência humana

As escolhas humanas podem redirecionar substancialmente a trajetória da IA.

64 / 100

Pouca influênciaForte influência

Intervalo de interpretação de 48 a 77 na escala qualitativa.

Ritmo de desenvolvimento

Interromper ou desacelerar substancialmente o desenvolvimento de uma IA mais capaz.

Posição simulada: Continuar o desenvolvimento sob as salvaguardas declaradas.

Acelerar o desenvolvimento de uma IA mais capaz.

Regras para o uso da IA

Restringir os usos da IA discutidos até que proteções prévias ou uma autorização estejam em vigor.

Posição simulada: Permitir os usos da IA discutidos com responsabilização e proteções específicas.

Minimizar as restrições aos usos da IA discutidos.

Estas interpretações mantêm as condições que essa pessoa declarou. Tanto os benefícios quanto os danos podem ser substanciais. Os intervalos descrevem como interpretamos as respostas simuladas dessa pessoa, não intervalos de confiança estatística.

Onde você se situa em relação a xlr8harder?
Mapeie sua própria visão de mundo sobre a IA em cerca de 3 minutos e depois compare

Visões de mundo semelhantes

Líderes de opinião cujas visões de mundo simuladas são mais próximas da visão de xlr8harder

Avaliação simulada

Pergunta 1

O que você acha que a IA significa para o nosso futuro — e por quê?

I expect AI to be broadly transformative, but the outcome depends heavily on how systems are built, tested, and governed. In areas such as healthcare and cybersecurity, capable models could produce substantial benefits. That makes delay costly too: safety discussions should count harms caused by withholding useful systems, not only harms caused by deploying them. At the same time, I do not trust frontier labs—or governments—to settle these questions behind closed doors. We need substantial transparency, repeated audits, and empirical investigation of what interventions actually do. For example, watermarking should be evaluated for reliability, quality degradation, privacy implications, identifiability, and adversarial robustness. Refusal policies likewise need examination as implemented, rather than being accepted because their stated intent sounds reasonable. I am also interested in whether stable, coherent model identity could produce more reliable behavior than layers of brittle imposed rules. That is a research direction, not a settled result. More generally, I would prioritize ordinary security engineering and observable failures before reaching for exotic threat explanations. Carefully targeted regulation can be justified where risks are concrete, but secrecy, broad discretionary power, and industry-written restrictions are poor foundations for governing something this consequential.

Pergunta 2

Taking benefits and harms together, what overall impact do you expect AI to have?

Overall, I expect AI to have a positive but highly contingent impact. The potential gains in healthcare, cybersecurity, and other knowledge-intensive work are substantial, and delaying beneficial deployment can itself cause real harm. But that expectation depends on institutions not turning safety into opaque control. Frontier systems need repeated audits, meaningful transparency, and empirical testing of interventions such as refusals and watermarks. I would not attach a numerical forecast: too much depends on deployment choices, security practices, and governance. My default is guarded optimism—not because the harms are trivial, but because many are observable and tractable if we investigate them openly rather than relying on secrecy, speculative threats, or brittle rules.

Pergunta 3

Que evidência mudaria sua visão sobre se as pessoas podem controlar uma IA poderosa?

I would update toward pessimism if repeated, independent audits showed that powerful systems consistently evade oversight, conceal relevant behavior, or defeat containment under realistic conditions—not merely in contrived demonstrations—and if ordinary security improvements failed to reduce those problems. I would update toward greater confidence if independently reproducible evidence showed reliable behavior across changing contexts, robust monitoring and access controls, and interventions that survived adversarial testing without unacceptable losses in capability, privacy, or user control. I would especially want comparisons between imposed rule systems and approaches based on stable, coherent model identity. The key is observable performance rather than assurances from labs, regulators, or theoretical arguments. One dramatic failure matters, but so does whether it reflects an intrinsic control problem or preventable failures such as weak credentials, poor compartmentalization, or inadequate auditing. Transparency is essential because claims of control that outsiders cannot inspect are not strong evidence of control.

Fontes

Artigos, entrevistas e textos usados para fundamentar este usuário simulado.

Onde você se situa?
Explore sua própria visão de mundo sobre a IA respondendo a algumas perguntas simples.
Mapeie sua própria visão de mundo

Onde você se situa?

Mapear minha visão de mundo