Pergunta 1
Theia Vogel
x.com/voooooogelAI researcher who runs experiments on language model introspection and personas and maintains an open-source library for steering models.
Como a IA mudará o mundo?
Na horizontal: a perspectiva Doom–Bloom expressa por essa pessoa. Para cima: escala da transformação.
Doom–Bloom: 50 de 100. Escala da transformação: 49 de 100. Intervalos de interpretação: 45 a 55 na horizontal, 0 a 100 na vertical. Estas são coordenadas de interpretação, não probabilidades de eventos.
≈11%
Inferido a partir das respostas simuladas dessa pessoa, não de um número que ela forneceu. Intervalo plausível: 3–34%.
Uma premissa central
It still needs compute, money, access, and some comparative advantage against organizations operating inference at hyperscale.Resposta 1
Se essa premissa se revelasse diferente, como a perspectiva dessa pessoa mudaria?
Uma questão não resolvida
Whether such attacks transfer to prompt-only settings remains an empirical question, not a result we can casually assume.Resposta 1
O que ajudaria essa pessoa a distinguir os resultados plausíveis aqui?
Mais detalhes
Danos graves ou generalizados são uma parte relevante do futuro esperado.
53 / 100
Intervalo de interpretação de 33 a 67 na escala qualitativa.
As escolhas humanas têm uma influência significativa, mas substancialmente limitada.
53 / 100
Intervalo de interpretação de 46 a 79 na escala qualitativa.
Estas interpretações mantêm as condições que essa pessoa declarou. Tanto os benefícios quanto os danos podem ser substanciais. Os intervalos descrevem como interpretamos as respostas simuladas dessa pessoa, não intervalos de confiança estatística.
Visões de mundo semelhantes
Líderes de opinião cujas visões de mundo simuladas são mais próximas da visão de Theia Vogel
Avaliação simulada
Fontes
Artigos, entrevistas e textos usados para fundamentar este usuário simulado.
Experiments test whether an open 32B model can detect interventions to internal state, finding prompt-sensitive success and limits to simple logit-lens explanations.

Author-hosted tweets document creative world simulation, steering work and a deliberately satirical statement of AI stance.

Identifies LLM persona research, open steering tools and prior DNA-synthesis screening work.

Demonstrates activation steering, contrasts it with prompting, and discusses jailbreaking, entangled self-awareness vectors and unresolved interpretation of what vectors change.

Onde você se situa?
Mapear minha visão de mundo