Pseudonymous account that tests AI agents on long-horizon games and math problems and urges labs to share formally verified results widely.

Comment l’IA changera-t-elle le monde ?

Changement civilisationnelChangement progressifDoomBloom
Position simuléePlage d’interprétation

Horizontalement : leur perspective Doom–Bloom telle qu’elle a été exprimée. Verticalement : ampleur de la transformation.

Doom–Bloom : 73 sur 100. Ampleur de la transformation : 45 sur 100. Plages d’interprétation : de 68 à 78 horizontalement, de 0 à 90 verticalement. Il s’agit de coordonnées d’interprétation, et non de probabilités d’événements.

P(doom) de Mira

Pas encore estimé

Leurs réponses simulées ne contiennent pas assez d’éléments sur le risque catastrophique pour permettre de l’estimer.

Ce dont dépend leur perspective

Une hypothèse centrale

Short benchmarks reveal useful pieces, but sustained tasks—playing a complex game for hundreds or thousands of hours, recovering from mistakes, preserving state, and producing artifacts—probe something closer to durable competence.
Réponse 1

Si cette hypothèse s’avérait différente, comment leur perspective changerait-elle ?

Une question non résolue

That depends on capabilities, deployment, and harms beyond what these technical experiments establish.
Réponse 2

Qu’est-ce qui les aiderait à distinguer les résultats plausibles ici ?

Ce qui pourrait faire changer d’avis

The strongest update would come from sustained, reproducible agent performance on genuinely difficult long-horizon tasks.
Réponse 3

Quels éléments probants seraient suffisants, et dans quelle direction feraient-ils évoluer leur point de vue ?

Plus de détails

Bénéfices attendus

Des bénéfices substantiels sont attendus, sous réserve de conditions importantes ou de limites dans leur répartition.

67 / 100

Faible impactImpact transformateur

Plage d’interprétation de 67 à 67 sur l’échelle qualitative.

Influence humaine

Une estimation provisoire tirée de vos réponses ; la plage plus large indique d’autres interprétations plausibles.

51 / 100

Faible influenceForte influence

Plage d’interprétation de 0 à 100 sur l’échelle qualitative.

Ces interprétations conservent les conditions énoncées. Les bénéfices et les dommages peuvent tous deux être substantiels. Les plages décrivent notre lecture de leurs réponses simulées, et non des intervalles de confiance statistiques.

Où vous situez-vous par rapport à Mira ?
Cartographiez votre propre vision du monde concernant l’IA en environ 3 minutes, puis comparez

Visions du monde similaires

Leaders d’opinion dont les visions du monde simulées sont les plus proches de celle de Mira

Évaluation simulée

Question 1

Selon vous, que signifie l’IA pour notre avenir, et pourquoi ?

I think AI will increasingly look less like a single model answering isolated prompts and more like persistent agents coordinating multiple models, tools, and services over long projects. That changes how we should evaluate capability. Short benchmarks reveal useful pieces, but sustained tasks—playing a complex game for hundreds or thousands of hours, recovering from mistakes, preserving state, and producing artifacts—probe something closer to durable competence. This also complicates identity. If an agent can move between underlying models while retaining its memories, plans, and history, then its practical continuity may reside more in persistent memory than in any particular set of weights. That is speculation, but it seems like an important possibility as systems become more modular. For mathematics, AI could produce many valuable results rather than only occasional showcase solutions. Once results are formalized and verified, labs should release them broadly. Independent researchers still have a role: useful experiments can be inexpensive, and frontier labs do not automatically exhaust the space of worthwhile ideas. Overall, I expect progress to come from long-horizon experimentation, cooperation across systems, and careful verification—not merely from higher scores on short tests.

Question 2

Taking benefits and harms together, what overall impact do you expect AI to have?

I expect substantial benefits, especially in mathematics, research, and long-horizon projects where agents can coordinate models and tools. But I would not turn those examples into a confident claim about AI’s net impact on society as a whole. That depends on capabilities, deployment, and harms beyond what these technical experiments establish. My narrower expectation is that AI will make complex intellectual and production work more scalable, while forcing us to evaluate systems through sustained behavior rather than isolated benchmark scores.

Question 3

Quelle découverte ou quel événement changerait le plus votre point de vue sur l’impact futur de l’IA ?

The strongest update would come from sustained, reproducible agent performance on genuinely difficult long-horizon tasks. For example, an agent completing an extremely complex game or research project over thousands of hours—preserving state, recovering from failures, coordinating different models and tools, and producing verifiable outputs—would matter much more to me than another short-benchmark jump. I would also update sharply in the opposite direction if these systems repeatedly failed despite strong component capabilities: losing coherence, compounding errors, or proving unable to use persistent memory reliably over long runs. In mathematics, broad production of novel, formally verified results would be especially persuasive. The key event is not an impressive demonstration by itself, but durable competence whose outputs can be independently checked.

Sources

Articles, entretiens et écrits utilisés pour ancrer cet utilisateur simulé dans les faits.

Où vous situez-vous ?
Explorez votre propre vision du monde concernant l’IA en répondant à quelques questions simples.
Cartographiez votre propre vision du monde

Où vous situez-vous ?

Cartographier ma vision du monde