OpenAI社長「AGI時代に入った」 GPT-6 Astraは本当に人間を超えたのか?

OpenAI社長「AGI時代に入った」 GPT-6 Astraは本当に人間を超えたのか?

何が起きた?

OpenAIは2026年9月3日、新しいAIモデル「GPT-6 Astra」を発表しました。PC操作、Web検索、プログラミング、科学研究などで大きく能力を伸ばしたモデルです。

そして発表時に注目を集めたのが、OpenAI社長グレッグ・ブロックマン氏の発言です。

ブロックマン氏は記者向け説明会の最後に「Welcome to the AGI era(AGI時代へようこそ)」と発言。さらに、将来振り返ったときに「AGIが生まれたのはこの時期、このモデルだった」と考えられる可能性があり、自分自身としては「すでに到達したと思う」という考えを示しました。

かなり大きな発言ですが、注意したいのは、OpenAIが会社として「AGIを正式に完成させました」と発表したわけではないことです。

OpenAIのAstra公式発表にも、「AGIを達成した」という記述はありません。

簡単にいうと

これまでのAIは、ものすごく物知りな「相談相手」に近い存在でした。

質問すれば答えてくれるし、文章やプログラムも作ってくれます。しかし実際の仕事では、その答えを見ながら人間がブラウザを開き、Excelを操作し、予定を登録し、ファイルを作る必要がありました。

Astraが大きく伸ばしたのは、この**「答える」と「実際にやる」の間**です。

たとえば「条件に合う物件を調べて比較表を作って」と頼めば、Webを調べ、必要な情報を集め、表を作るところまでAIが進める。フォーム入力、予定整理、文書作成、ソフトウェアのインストールやテストなども自分で操作できます。

つまり今回の進化は、

「ものすごく頭のいいAI」から「仕事そのものを任せられるAI」へ近づいた

と考えると分かりやすいでしょう。

それで何が変わる?

Astraが一般ユーザーにとって重要なのは、単純な質問への回答精度よりも、複数の作業をまとめて任せられるようになることです。

OpenAIのテストでは、PC操作を評価する「OSWorld 2.0」で、GPT-5.6 Solの65.7%からAstraは72.6%へ向上しました。

さらに、1つの仕事にかかる時間は約75分から約40分へ短縮されたとしています。

業務自動化を評価する「AutomationBench」では、GPT-5.6 Solの18.1%からAstraは41.4%へと大きく上昇しました。

つまり今後、

「この資料を読んで」

ではなく、

「この資料を調べて、必要な数字をまとめて、Excelにして、報告書まで作って」

という使い方が現実的になっていく可能性があります。

OpenAIはAstraを一部組織から提供開始し、ChatGPT Plus、Pro、Business、Enterpriseにも数日かけて展開するとしています。

一方で、能力が高くなった分だけ危険性も増しています。

AstraはOpenAIの安全基準で、初めてサイバー攻撃能力が最も高い「Critical」に達したモデルです。適切な道具とアクセス権があれば、未知のソフトウェアの弱点を見つけ、人間が一手ずつ指示しなくても攻撃方法を作れる水準だとOpenAI自身が評価しています。

便利さだけでなく、「AIにどこまでPC操作を任せるのか」という問題も、これまで以上に重要になります。

AGIって結局何?

AGIは「Artificial General Intelligence」の略で、日本語では「汎用人工知能」と呼ばれます。

ただし、世界共通の明確な合格ラインがあるわけではありません

OpenAIの憲章ではAGIを、

「経済的に価値のある仕事の大部分で人間を上回る、高度に自律的なシステム」

という意味で定義しています。

重要なのは、AGIだからといって必ずしも、

「人間と同じ意識を持つ」

「人間と同じ感情を持つ」

「ありとあらゆる能力で全人類を上回る」

という意味ではないことです。

たとえばチェスAIは世界チャンピオンより強くても、確定申告はできません。

反対にAGIとは、初めて見る問題でも状況を理解し、必要な知識を覚え、道具を使って、さまざまな種類の仕事をこなせるAIを意味する場合が多くなっています。

ARC Prize FoundationはAGIを「人間が習得できるあらゆる技能を、人間と同程度の効率で習得できるシステム」と定義しています。

つまり「AGI」という言葉自体が、誰が定義するかによって少し意味が変わるのです。

実際、OpenAI CEOのサム・アルトマン氏自身も最近、AGIは非常に定義が曖昧な言葉だという趣旨の発言をしています。

本当に人間を超えた?

答えは、

「一部では人間を超え始めている。しかし、人間全体を超えたとはまだ言えない」

が最も正確です。

特に話題になったのが「ARC-AGI-3」というテストです。

これはAIに初めて見る環境を与え、試行錯誤しながらルールを発見し、目的を達成できるかを調べるものです。

OpenAIはAstraについて「ARC-AGI-3で99.9%」と発表しました。

しかもAstraは、クリアしたステージの96%で、人間の中央値より少ない操作回数で問題を解決しました。

「知らない世界のルールを自分で理解して攻略する」という能力では、確かに人間並み、あるいは人間以上の結果が出ています。

ただし、ここには重要な注意点があります。

99.9%という数字は、OpenAI側の長い思考状態などを引き継げる専用環境を使った場合です。

各社のAIを同じ条件で比較する標準環境では、Astraの成績は**62.7%**でした。

さらにARC Prize Foundation自身が、

このテストを攻略したことはAGI達成の証明ではない

と明確にしています。

ARC-AGI-3は閉じられたルールの世界です。実社会の仕事のように、目的そのものが曖昧だったり、情報が間違っていたり、人間関係を考えたりする必要まではありません。

もう一つ興味深い結果があります。

独立評価機関Artificial Analysisの総合的な「Intelligence Index」では、Astraは61点。

前世代のGPT-5.6 Solも61点でした。

つまり、

「GPT-6になって突然、人間より何倍も賢くなった」わけではありません。

一方で、プログラミングや長時間の作業、PC操作、科学研究など、「考えたことを実際の作業として進める能力」は大きく向上しています。

その意味では、ブロックマン氏の「AGI時代」という発言は、完全な間違いとも言い切れません。

ただし現時点では、

「人間を超える万能知能が完成した」という意味のAGIではなく、「人間がPCで行う多くの仕事を自律的に任せられるAIが現れ始めた」

という意味で捉えるのが妥当でしょう。

そして社会にとって本当に大きな変化になるのは、「AGIという名前が付いた日」ではなく、AIに仕事を任せることが普通になった日なのかもしれません。

情報源