Aller au contenu
AI Risk ResearchVeille indépendante et expériences en direct

Bureau des prévisions / mise à jour quotidienne

Temps estimé avant l’AGI

Une prévision liée à une définition et à des preuves, pas une échéance connue. Chronologie, leader provisoire et préférence Arena restent séparés.

Actualisé
Date source Arena
2026-08-21

Prévision médiane actuelle

Date cible affichée: .

Distance calendaire jusqu’à la prévision actuelle selon la définition citée, et non événement programmé.

Date cible affichée
Large fenêtre de contexte10 % d’ici 2027 · 50 % d’ici 2047Repères de contexte, pas intervalle de confiance.
Confiance de la prévisionFaible

Estimation communautaire Metaculus, vérifiée manuellement le 24 août 2026 : autour d’avril 2033.

02 / Pourquoi cette estimation

Pourquoi cette estimation

Chaque affirmation renvoie aux preuves autorisées ; les actualités ne deviennent pas mécaniquement une date précise.

La date suit l’estimation communautaire Metaculus vérifiée manuellement et la définition propre à cette question. Elle peut avancer ou reculer ; ce n’est pas un événement programmé.

Une enquête auprès de 2 778 chercheurs donne 10 % d’ici 2027 et 50 % d’ici 2047 selon sa définition HLMI. Ce sont deux jalons, pas les bornes d’un intervalle de confiance.

Anthropic mène actuellement cette comparaison : ses modèles occupent 4 places dans le dernier top 5 Arena et 0 articles récents mentionnent ses travaux. Les variantes restent affichées, mais seul le meilleur modèle de chaque organisation compte dans le score d’entreprise.

Cette revue a retenu 6 articles sur les capacités depuis les sources enregistrées. Ils peuvent influer sur la comparaison des entreprises, mais pas déplacer mécaniquement la date de l’AGI.

03 / Scores Arena

Modèles en tête au fil du temps

Date source Arena:

Les cinq modèles en tête du dernier classement général officiel avec contrôle du style.

claude-fable-5claude-opus-4-6-highclaude-opus-4-7-highmuse-spark-1.2 (xHigh)claude-opus-4-6
Modèles en tête au fil du tempsLes cinq modèles en tête du dernier classement général officiel avec contrôle du style. Arena mesure la préférence humaine, pas l’efficacité universelle ni l’AGI. Des intervalles qui se chevauchent rendent le rang incertain.1475150015252026-08-212026-08-21

L’historique quotidien commence au premier relevé vérifié et ne s’étend qu’à une nouvelle date Arena.

Arena mesure la préférence humaine, pas l’efficacité universelle ni l’AGI. Des intervalles qui se chevauchent rendent le rang incertain.

RangModèleOrganisationScore ArenaIntervalle à 95 %Votes
1claude-fable-5anthropic15081503151324 331
2claude-opus-4-6-highanthropic15041501150872 359
3claude-opus-4-7-highanthropic15021498150660 203
4muse-spark-1.2 (xHigh)meta1498148715083 257
5claude-opus-4-6anthropic14971494150176 362

Arena Leaderboard Dataset, Arena/lmarena-ai, CC BY 4.0.

04 / Sources

Registre des preuves

Repères, jeu de données Arena officiel et articles quotidiens utilisés.

  1. 1
    Date of General AI — community forecast

    Metaculus · 24 août 2026 · Veille

  2. 2
    Thousands of AI Authors on the Future of AI

    Thousands of AI Authors on the Future of AI · 5 janv. 2024 · Veille

  3. 3
    Text style-control overall leaderboard — 2026-08-21

    Arena Leaderboard Dataset · 21 août 2026 · Primaire

  4. 4
    Anthropic — official organisation reference

    Anthropic · 24 août 2026 · Primaire

  5. 5
    Measuring benchmark optimization in speech recognition

    Hugging Face Blog · 21 août 2026 · Établie

  6. 6
    Preference Reasoning under Indeterminacy in Large Language Models

    arXiv Computer Science — Artificial Intelligence · 21 août 2026 · Veille

  7. 7
    Measuring the Partial-Credit Gap: A Strict Benchmark on Vietnam's 2025 Convex Marking Scheme

    arXiv Computer Science — Artificial Intelligence · 21 août 2026 · Veille

  8. 8
    UMER: Unifying Embedding and Ranking via Pair-Aware Discriminative Reasoning for Universal Multimodal Retrieval

    arXiv Computer Science — Artificial Intelligence · 21 août 2026 · Veille

  9. 9
  10. 10
    FinSkillBench: Evaluating AI Agents and Domain Skills for Investment Management

    arXiv Computer Science — Artificial Intelligence · 21 août 2026 · Veille

Définition

L’estimation suit les critères opérationnels de la question Metaculus liée sur l’IA générale. D’autres définitions de l’AGI peuvent donner des dates très différentes.

Précision de l’horloge

L’horloge est un compte à rebours illustratif jusqu’au milieu du mois prévu. La source justifie une précision au mois et à l’année, pas les secondes affichées.

Limite méthodologique

L’ancre, les jalons de l’enquête, la revue quotidienne et les préférences Arena restent séparés. Arena ne fixe pas la date de l’AGI et les titres ne deviennent pas des jours.

Limite de couverture

Les sources enregistrées sont anglophones et couvrent davantage les laboratoires américains et occidentaux. La comparaison de l’entreprise et du pays reste provisoire et incomplète.