コンテンツへ移動
AI Risk Research独立監視とライブ実験

予測デスク / 根拠を毎日確認

AGI到達までの推定時間

定義と証拠に結び付いた予測であり、既知の期限ではありません。時系列、暫定的な開発者リーダー、Arenaの選好評価は分けて示します。

更新
Arena情報源の日付
2026-08-21

手動確認したコミュニティ予測

予測時期: .

引用した運用定義における現在の予測日までの暦上の距離であり、予定された出来事ではありません。

予測時期
専門家調査の節目2027年までに10% · 2047年までに50%別々の確率上の節目であり、予測区間ではありません。
予測の確信度低い

Metaculusのコミュニティ予測(2026年8月24日に手動確認):2033年4月ごろ。

02 / 推定の根拠

この推定になった理由

各説明は根拠として使用できる証拠にリンクしています。ニュースを機械的に正確な日付へ変換しません。

予測日は、AGIの判定基準を明示したMetaculusのコミュニティ予測を手動で確認した値です。前後に動く可能性があり、予定日ではありません。

AI研究者2,778人への調査では、調査独自のHLMI定義のもと、2027年までに10%、2047年までに50%と回答されています。これは2つの節目であり、信頼区間の両端ではありません。

現在の比較ではAnthropicが最も有力です。同社のモデルは最新のArena上位5位以内に4モデル入り、最近の能力関連記事0件で取り上げられています。表示ではモデルの各バージョンを残しますが、企業比較のArena得点には各組織で最上位の1モデルだけを使います。

今回の確認では、登録フィードから能力に関係する記事6件を選びました。企業比較には反映しますが、AGI予測日を機械的に動かす材料にはしません。

03 / Arena評価

時系列で見る先行モデル

Arena情報源の日付:

最新の公式テキスト・スタイル制御総合スナップショット上位5モデル。

claude-fable-5claude-opus-4-6-highclaude-opus-4-7-highmuse-spark-1.2 (xHigh)claude-opus-4-6
時系列で見る先行モデル最新の公式テキスト・スタイル制御総合スナップショット上位5モデル。 Arenaは人間の選好評価であり、普遍的な有効性やAGIの尺度ではありません。区間が重なる場合、順位は決定的ではありません。1475150015252026-08-212026-08-21

日次履歴は最初の検証済みスナップショットから始まり、Arenaが新しい日付を公開した時だけ延長されます。

Arenaは人間の選好評価であり、普遍的な有効性やAGIの尺度ではありません。区間が重なる場合、順位は決定的ではありません。

順位モデル組織Arena評価95%区間投票数
1claude-fable-5anthropic15081503151324,331
2claude-opus-4-6-highanthropic15041501150872,359
3claude-opus-4-7-highanthropic15021498150660,203
4muse-spark-1.2 (xHigh)meta1498148715083,257
5claude-opus-4-6anthropic14971494150176,362

Arena Leaderboard Dataset, Arena/lmarena-ai, CC BY 4.0.

04 / 根拠と出典

根拠と出典

この版で使用した予測基準、公式Arenaデータセット、日次フィード記事。

  1. 1
    Date of General AI — community forecast

    Metaculus · 2026/08/24 · 観察情報源

  2. 2
    Thousands of AI Authors on the Future of AI

    Thousands of AI Authors on the Future of AI · 2024/01/05 · 観察情報源

  3. 3
    Text style-control overall leaderboard — 2026-08-21

    Arena Leaderboard Dataset · 2026/08/21 · 一次資料

  4. 4
    Anthropic — official organisation reference

    Anthropic · 2026/08/24 · 一次資料

  5. 5
    Measuring benchmark optimization in speech recognition

    Hugging Face Blog · 2026/08/21 · 確立した情報源

  6. 6
    Preference Reasoning under Indeterminacy in Large Language Models

    arXiv Computer Science — Artificial Intelligence · 2026/08/21 · 観察情報源

  7. 7
    Measuring the Partial-Credit Gap: A Strict Benchmark on Vietnam's 2025 Convex Marking Scheme

    arXiv Computer Science — Artificial Intelligence · 2026/08/21 · 観察情報源

  8. 8
    UMER: Unifying Embedding and Ranking via Pair-Aware Discriminative Reasoning for Universal Multimodal Retrieval

    arXiv Computer Science — Artificial Intelligence · 2026/08/21 · 観察情報源

  9. 9
  10. 10
    FinSkillBench: Evaluating AI Agents and Domain Skills for Investment Management

    arXiv Computer Science — Artificial Intelligence · 2026/08/21 · 観察情報源

定義

日付は、リンク先のMetaculus「General AI」予測が定める判定基準に沿っています。AGIの定義が異なれば、予測時期も大きく変わります。

予測の精度

動く時計は、予測月の中日までを暦上で示す演出です。根拠が示す精度は年月までで、表示される秒単位ではありません。

この予測で分かること・分からないこと

予測日の基準、専門家調査の節目、日々のニュース確認、Arenaの人間選好評価は別々に扱います。Arenaの順位や記事見出しからAGIの日付を機械的に算出することはありません。

情報源の範囲

登録フィードは英語圏が中心で、米国や欧米の研究組織を多く扱います。そのため、企業と本社所在国の比較は暫定的で、網羅的ではありません。