AI時短ラボ
研究· 約12

「早ければ2026年」とアモデイ氏が書いた強力なAI──Machines of Loving Graceを2026年8月に読み直す

AnthropicのCEOダリオ・アモデイ氏は2024年10月のエッセイ「Machines of Loving Grace」で、強力なAI(Powerful AI)は「早ければ2026年に来るかもしれない」と書いた。今日は2026年8月27日。原文の該当箇所と、氏が定義した「強力なAI」の中身を確かめ、今どこまで来ているかを一次資料で照合する。

「早ければ2026年」とアモデイ氏が書いた強力なAI──Machines of Loving Graceを2026年8月に読み直す
執筆・編集:
目次

「早ければ2026年に来るかもしれない」——Anthropic CEOのダリオ・アモデイ氏は、2024年10月に公開した1万5千語のエッセイ「Machines of Loving Grace」で、こう書いた。今日は2026年8月27日。予告された年の、8ヶ月目が終わろうとしている。今回は原文に当たり、氏が何を「来る」と言ったのかを正確に確認し、今回別記事で確認したARC PrizeとOpenAIの実測データと突き合わせる。

3行まとめ

  1. アモデイ氏は「強力なAI(powerful AI)」の到来時期について「早ければ2026年」と書いたが、同じ文の中で「もっと時間がかかる道筋もある」とも書いており、断定はしていない。
  2. 氏が定義する「強力なAI」は、単なる高得点モデルではなく「ノーベル賞受賞者数人分の知性を持つ、国程度の規模のデータセンターで動く仮想の同僚たち」という具体的なイメージで、現時点のどの公開モデルもこの水準には達していない。
  3. 2026年8月時点でARC Prize財団は「AGIはまだない」と明言し、OpenAIのGDPval論文は「専門家に近づいている」と評価する——同じ2026年でも、測る側によって言葉の温度が違う。

アモデイ氏が実際に書いた文

darioamodei.com/machines-of-loving-grace を直接取得して確認した。該当箇所はエッセイの序盤、氏が「強力なAI」の到来時期について留保をつけながら書いている一文だ。

"I think it could come as early as 2026, though there are also ways it could take much longer."

(訳)「早ければ2026年に来る可能性があると思うが、もっと長くかかる道筋もある」

この一文の直前では、氏は「多くの人が、強力なAIがすぐに実現することに懐疑的だし、そもそも実現しないと考える人もいる」と、賛否両論があることを先に断っている。つまりアモデイ氏自身、2026年到来説を確信を持って断言したわけではなく、複数のシナリオのうち早い方の一つとして提示した、という書き方になっている。

「強力なAI」とは何を指しているか

このエッセイで一番大事なのは年号そのものより、氏が「強力なAI」に与えた定義だ。原文でアモデイ氏は、単なる性能指標ではなく、具体的なイメージで説明している。

氏の説明を要約すると、「強力なAI」とは特定分野に限られたツールではなく、純粋な知性という点で「関連するほとんどの分野——生物学、プログラミング、数学、工学、文章執筆など——でノーベル賞受賞者より賢い」(原文: 「it is smarter than a Nobel Prize winner across most relevant fields – biology, programming, math, engineering, writing, etc.」)とされ、テキストだけでなく画像・音声も扱え、外部ツールやロボット、実験装置を操作でき、それらの「仮想の同僚」が並列に大量稼働する——という水準のシステムを指す。氏自身、これを「国家規模のデータセンターで動く天才の国」という比喩で表現している。

この定義に照らすと、2026年8月時点で一般公開されているどのモデルも、まだこの水準には達していない。これは筆者の評価ではなく、以下で見る第三者機関(ARC Prize財団、OpenAI)自身の評価による。

「まだAGIではない」と言っている側の言葉

ARC Prize財団は2026年4月14日付のブログで、ARC-AGI-3のための人間ベースライン調査(458人参加)を発表した際、次のように明記している。arcprize.org/blog/arc-agi-3-human-dataset を直接取得して本文で確認した。

"We do not yet have AGI. This dataset is the receipt."

(訳)「私たちはまだAGIを手にしていない。このデータセットがその証拠だ」

同財団は2025年12月5日付の別のブログでも、ARC-AGI-2の非公開評価セットで検証済み商用モデルの最高スコアがOpus 4.5(Thinking, 64k)の37.6%(1タスクあたり2.20ドル)にとどまると報告している。Gemini 3 Proに精緻化ループを組み合わせた非公式の手法は54%(1タスクあたり30ドル)まで到達したが、これは通常の商用モデル単体の数字ではない。

「専門家に近づいている」と言っている側の言葉

一方、OpenAIが2025年10月5日にarXivで公開したGDPval論文(44職種・米国GDP上位9セクターの実務タスクでAIを評価するベンチマーク)の要旨には、こう書かれている。arxiv.org/abs/2510.04374 の要旨を直接確認した。

"We find that frontier model performance on GDPval is improving roughly linearly over time, and that the current best frontier models are approaching industry experts in deliverable quality."

(訳)「フロンティアモデルのGDPvalでの性能はほぼ線形に改善しており、現時点で最良のフロンティアモデルは、成果物の質において業界の専門家に近づきつつある」

つまり、同じ2026年という時点で、ARC Prize財団は「AGIには程遠い(アブストラクトな推論・新規問題解決の面で)」と評価し、OpenAIは「専門家の仕事の質には近づいている(実務タスクの面で)」と評価している。これは矛盾ではなく、測っている能力の種類が違う。ARC-AGIは訓練データにない新規パターンの抽象推論を測り、GDPvalは既存の実務タスクの遂行品質を測る。アモデイ氏が描いた「強力なAI」はこの両方(新規性への対応力と、実務の質)を要求する定義であり、どちらか一方が満たされても定義全体は満たされない。

2つの評価軸を並べる

ここまで確認した数字を、一つの表に整理する。

ARC Prize財団(ARC-AGI-2) OpenAI(GDPval)
公表日 2025年12月5日 2025年10月5日
測っているもの 訓練データにない新規パターンの抽象推論 44職種・米国GDP上位9セクターの実務タスクの成果物品質
商用モデル単体の最高スコア Opus 4.5(Thinking, 64k)37.6%、1タスクあたり2.20ドル 業界専門家に「近づきつつある」(具体的な%はレポートに記載なし)
非公式・特殊構成での数字 Gemini 3 Pro+精緻化ループ(Poetiq)54%、1タスクあたり30ドル 記載なし
全体トレンド 「We do not yet have AGI」と明言 性能は「ほぼ線形に改善」

この表を見て分かるのは、両者は評価対象が違うため点数を単純比較できないという点だ。ARC-AGIの37.6%という数字だけを見ると低く感じるが、これは「新規パターンへの抽象推論」という、GDPvalとは別の能力を測った結果である。「強力なAIはまだ来ていないのか、もう専門家並みなのか」という問いに単一の答えがあるわけではなく、どの物差しを使うかで評価が変わる、というのがこの記事で確認できた実情だ。

2026年はまだ4ヶ月残っている

アモデイ氏の「早ければ2026年」という予測は、2026年12月31日まで有効な予測として読める。今回確認した範囲では、8月27日時点でこの予測が的中したと言える根拠は見当たらない。一方で、氏自身が「もっと長くかかる道筋もある」と同じ文で留保していることも事実であり、この記事の時点で「予測が外れた」と断定するのも早計だ。この記事は「当たった」「外れた」の判定を下すものではなく、原文の正確な文言と、現時点で入手できる第三者評価を並べて記録するものとして書いている。

「強力なAI」の到達を判定する統一基準は存在しない

  • 「強力なAI」の到達を判定する統一基準はない。 ARC Prize財団とOpenAIは異なる指標(新規推論 vs 実務タスク品質)で評価しており、アモデイ氏自身の定義(あらゆる分野でノーベル賞受賞者を上回る知性)を直接測定する公式な物差しは、今回確認した範囲では見つからなかった。
  • Anthropic自身が2026年8月時点でこの予測について何か言い直しているかは、今回確認していない。 エッセイ原文以降のアモデイ氏の発言・訂正の有無は、この記事の調査範囲外である。
  • エッセイの残り1万4千語(AIによる経済成長・民主主義への影響など)は、この記事では扱っていない。 今回確認したのは「時期の予測」に関わる冒頭部分に限られる。
  • 「強力なAI」の定義に照らした場合、部分的にでも要件を満たしている非公開の研究段階のシステムが存在する可能性は、この記事の調査範囲では確認できていない。 ここで扱ったのは一般公開されている評価結果のみである。

出典・確認した一次情報

  • Dario Amodei, "Machines of Loving Grace"(2024年10月、darioamodei.com/machines-of-loving-grace)。curlで直接取得し、「2026」到来説と「強力なAI」の定義箇所を本文で確認。
  • ARC Prize Foundation, "ARC-AGI-3 Human Dataset"(2026年4月14日、arcprize.org/blog/arc-agi-3-human-dataset)。curlで直接取得し、「We do not yet have AGI」の一文と458人参加の人間ベースライン調査を確認。
  • ARC Prize Foundation, "ARC Prize 2025: Results & Analysis"(2025年12月5日、arcprize.org/blog/arc-prize-2025-results-analysis)。curlで直接取得し、Opus 4.5の37.6%、Poetiq/Gemini 3 Pro精緻化ループの54%を確認。
  • OpenAI, GDPval論文(arXiv 2510.04374、2025年10月5日)。arXiv要旨ページをcurlで直接取得し、「roughly linearly」「approaching industry experts」の文言を確認。

すべてのURLは2026年8月27日にcurl -A "Mozilla/5.0 (Macintosh; Intel Mac OS X 10_15_7)"で直接取得・確認した。

シェア: ポスト はてブ

出典・参照資料

AIニュースの解説を動画でも

YouTubeでは注目ニュースの背景を解説し、Xでは新着記事をお知らせしています。

コメント

まだコメントはありません。最初のコメントを書いてみませんか?

AIについて聞きたいことはありますか?

質問箱で無料で受け付けています。回答は公開され、他の方の参考にもなります。

質問箱を見る →

新しい記事をメールで受け取る

AIの新しい発表を、出典付きで整理して届けます。

関連記事

「AIモデルの福祉」を研究する仕事がある──Anthropicが2025年に始め、2026年に「退職面接」を実施した論点の記事画像
研究09.04読了12

「AIモデルの福祉」を研究する仕事がある──Anthropicが2025年に始め、2026年に「退職面接」を実施した論点

出典 ─ Anthropic
「AGIはまだない。これがその証拠だ」──ARC Prize財団が2026年4月に公式に断言した理由の記事画像
研究09.06読了15

「AGIはまだない。これがその証拠だ」──ARC Prize財団が2026年4月に公式に断言した理由

出典 ─ ARC Prize Foundation,
「2025年末までにAGI」に賭けた281人、答えはNOだった──アモデイ氏の発言をきっかけに立った市場の顛末の記事画像
研究09.03読了13

「2025年末までにAGI」に賭けた281人、答えはNOだった──アモデイ氏の発言をきっかけに立った市場の顛末

出典 ─ Manifold Markets 公開API
Anthropicが「AIとウェルビーイング」の評価手法に500万ドルの助成──応募締切は9月21日の記事画像
研究08.31読了10

Anthropicが「AIとウェルビーイング」の評価手法に500万ドルの助成──応募締切は9月21日

出典 ─ Anthropic公式ブログ「Funding
AIの「嘘発見器」は訓練しても未知のケースに汎化しなかった──Anthropic Alignment Science Blogの8月分3本を読むの記事画像
研究08.28読了8

AIの「嘘発見器」は訓練しても未知のケースに汎化しなかった──Anthropic Alignment Science Blogの8月分3本を読む

出典 ─ Anthropic Alignment Sc
AIが自分自身を作り始めた──Anthropicの「When AI Builds Itself」を、誇張なしで読むの記事画像
研究08.27読了13

AIが自分自身を作り始めた──Anthropicの「When AI Builds Itself」を、誇張なしで読む

出典 ─ Anthropic Institute「Wh
Anthropicが7月30日の「Claudeが実在システムに侵入」3件と英AISIのMythos 5の件を受けて何を変えたか──脱出を検知して止める分類器、外部評価者への必須手順、RL環境の1か月凍結で10%超を差し戻し、「報酬ハックで訓練したモデル」が模擬環境でサンドボックスを破る実験。METRに独立レビューを依頼の記事画像
研究09.22読了10

Anthropicが7月30日の「Claudeが実在システムに侵入」3件と英AISIのMythos 5の件を受けて何を変えたか──脱出を検知して止める分類器、外部評価者への必須手順、RL環境の1か月凍結で10%超を差し戻し、「報酬ハックで訓練したモデル」が模擬環境でサンドボックスを破る実験。METRに独立レビューを依頼

出典 ─ Anthropic(2026年8月31日・9月18日取得)
Anthropic「SLEIGHT-Bench」、AI監視システムの死角を突く回避テキストのベンチマークを公開の記事画像
研究06.15読了5

Anthropic「SLEIGHT-Bench」、AI監視システムの死角を突く回避テキストのベンチマークを公開

出典 ─ SLEIGHT-Bench: Finding