Pertanyaan 1
Theia Vogel
x.com/voooooogelAI researcher who runs experiments on language model introspection and personas and maintains an open-source library for steering models.
Bagaimana AI akan mengubah dunia?
Mendatar: pandangan Doom–Bloom yang mereka ungkapkan. Ke atas: skala transformasi.
Doom–Bloom: 50 dari 100. Skala transformasi: 49 dari 100. Rentang interpretasi: 45 hingga 55 secara horizontal, 0 hingga 100 secara vertikal. Ini adalah koordinat interpretasi, bukan probabilitas kejadian.
≈11%
Disimpulkan dari jawaban simulasi mereka, bukan angka yang mereka berikan. Rentang yang masuk akal: 3–34%.
Asumsi utama
It still needs compute, money, access, and some comparative advantage against organizations operating inference at hyperscale.Jawaban 1
Jika asumsi ini ternyata berbeda, bagaimana pandangan mereka akan berubah?
Pertanyaan yang belum terjawab
Whether such attacks transfer to prompt-only settings remains an empirical question, not a result we can casually assume.Jawaban 1
Apa yang akan membantu mereka membedakan hasil-hasil yang masuk akal di sini?
Detail lebih lanjut
Kerugian parah atau meluas merupakan bagian yang berarti dari masa depan yang diperkirakan.
53 / 100
Rentang interpretasi 33 hingga 67 pada skala kualitatif.
Pilihan manusia memiliki pengaruh yang berarti, tetapi sangat dibatasi.
53 / 100
Rentang interpretasi 46 hingga 79 pada skala kualitatif.
Interpretasi ini mempertahankan kondisi yang mereka nyatakan. Manfaat dan kerugian dapat sama-sama besar. Rentang tersebut menggambarkan cara kami membaca jawaban simulasi mereka, bukan interval kepercayaan statistik.
Pandangan dunia serupa
Pemimpin opini dengan pandangan dunia simulasi yang paling mendekati pandangan Theia Vogel
Penilaian Simulasi
Sumber
Artikel, wawancara, dan tulisan yang digunakan sebagai landasan bagi pengguna simulasi ini.
Experiments test whether an open 32B model can detect interventions to internal state, finding prompt-sensitive success and limits to simple logit-lens explanations.

Author-hosted tweets document creative world simulation, steering work and a deliberately satirical statement of AI stance.

Identifies LLM persona research, open steering tools and prior DNA-synthesis screening work.

Demonstrates activation steering, contrasts it with prompting, and discusses jailbreaking, entangled self-awareness vectors and unresolved interpretation of what vectors change.

Di mana posisi Anda?
Petakan pandangan dunia saya