Frage 1
Theia Vogel
x.com/voooooogelAI researcher who runs experiments on language model introspection and personas and maintains an open-source library for steering models.
Wie wird KI die Welt verändern?
Horizontal: deren geäußerter Doom–Bloom-Ausblick. Vertikal: Ausmaß der Transformation.
Doom–Bloom: 50 von 100. Ausmaß der Transformation: 49 von 100. Interpretationsbereiche: horizontal 45 bis 55, vertikal 0 bis 100. Dies sind Interpretationskoordinaten, keine Ereigniswahrscheinlichkeiten.
≈11%
Aus den simulierten Antworten dieser Person abgeleitet, keine von ihr genannte Zahl. Plausibler Bereich: 3–34%.
Eine zentrale Annahme
It still needs compute, money, access, and some comparative advantage against organizations operating inference at hyperscale.Antwort 1
Wenn sich diese Annahme als anders herausstellen würde, wie würde sich deren Einschätzung ändern?
Eine ungeklärte Frage
Whether such attacks transfer to prompt-only settings remains an empirical question, not a result we can casually assume.Antwort 1
Was würde ihnen helfen, die plausiblen Ergebnisse hier voneinander zu unterscheiden?
Weitere Details
Schwere oder weitverbreitete Schäden sind ein wesentlicher erwarteter Bestandteil der Zukunft.
53 / 100
Interpretationsbereich von 33 bis 67 auf der qualitativen Skala.
Menschliche Entscheidungen haben einen bedeutsamen, aber erheblich eingeschränkten Einfluss.
53 / 100
Interpretationsbereich von 46 bis 79 auf der qualitativen Skala.
Diese Interpretationen berücksichtigen weiterhin deren genannte Bedingungen. Vorteile und Schäden können beide erheblich sein. Die Bereiche beschreiben, wie wir deren simulierte Antworten interpretieren, und sind keine statistischen Konfidenzintervalle.
Ähnliche Weltsichten
Vordenker, deren simulierte Weltsichten der von Theia Vogel am nächsten kommen
Simulierte Einschätzung
Quellen
Artikel, Interviews und Schriften, die als Grundlage für diesen simulierten Nutzer dienen.
Experiments test whether an open 32B model can detect interventions to internal state, finding prompt-sensitive success and limits to simple logit-lens explanations.

Author-hosted tweets document creative world simulation, steering work and a deliberately satirical statement of AI stance.

Identifies LLM persona research, open steering tools and prior DNA-synthesis screening work.

Demonstrates activation steering, contrasts it with prompting, and discusses jailbreaking, entangled self-awareness vectors and unresolved interpretation of what vectors change.

Wo stehst du?
Meine Weltsicht abbilden