📊モデルリリースチャエン【AI研究所】

OpenAIがGPT-6 Astra発表!PC操作代行と驚異の推論能力

OpenAIが最新モデル「GPT-6 Astra」を発表しました。これまでの「答えるAI」から、ユーザーの指示を受けてPC画面を直接操作し、事務作業を完結させる「操作するAI」へと役割が大きく進化しています。OpenAI社長のグレッグ・ブロックマン氏は、本モデルがAGI(汎用人工知能)に最も近い存在であるとの見解を示しており、AI活用が新たなフェーズに入ったことを示唆しています。

背景

これまでのAI利用は、人間が指示を出し、AIの回答をもとに人間が作業を行うプロセスが一般的でした。しかし、OpenAIが公開した最新データによると、次世代モデルでは「AIによる作業の完結」が重視されています。前世代モデル「GPT-5.6 Sol」と比較して、事務作業の遂行能力や未知の課題に対する推論能力が飛躍的に向上しており、AIが単なる補助ツールを超え、自律的なエージェントとして機能する段階に到達しつつあります。

この動画の要点

1. PC作業の代行能力が大幅に向上しました。ベンチマーク「AutomationBench」において、前世代のGPT-5.6 Solが18.1%だった事務作業の完遂率が、GPT-6 Astraでは41.4%に達し、約2.3倍の進化を遂げています。これにより、AIが直接画面を操作して作業を終わらせるワークフローが可能になります。

2. 未知のパズルを解く推論能力が驚異的な数値を示しています。学習していない問題でもその場で解決する力を測るテストにおいて、前世代がわずか7.8%の正答率だったのに対し、GPT-6 Astraは99.9%というほぼ満点に近いスコアを記録しました。これはAIがパターン暗記ではなく、本質的な思考能力を獲得しつつある証拠と言えます。

3. サイバーセキュリティ分野でも「重大な水準」に達したと認定されました。脆弱性を突くテスト「ExploitBench」で100%の満点を記録し、防御と攻撃の両面で高い能力を発揮します。一方で、第三者機関の指標では「Claude Fable 5.1」が首位となるなど、自社発表以外のデータも踏まえた冷静な評価の重要性も説かれています。

なぜ重要か

GPT-6 Astraの登場は、AIが「知識の提供者」から「実務の執行者」へと変貌を遂げたことを象徴しています。特にPC操作の代行や、未学習パズルに対する99.9%の正答率は、従来のLLMの限界を超えた汎用性の高さを物語っています。しかし、編集者として注目すべきは、OpenAI自身がセキュリティ能力を「重大な水準」と認め、諸刃の剣としての側面を警戒している点です。また、自社ベンチマークでは圧倒的でも、第三者評価では競合のClaudeシリーズに及ばない項目があるという事実は、AI性能の評価が多角的かつ複雑化している現状を浮き彫りにしています。

こんな人におすすめ

AIの最新動向を追うビジネスパーソンや開発者に最適です。特に事務作業の自動化やAIエージェントの進化に興味がある人にとって、次世代モデルがどの程度の実行能力(PC操作や高度な推論)を備えているのか、具体的な数値データとともに把握できる内容となっています。

見どころ

この記事は チャエン【AI研究所】 が公開した動画をAI(Google Gemini)が視聴して 日本語にまとめ、公開前に運営者が内容を確認したうえで掲載しています。 要約の性質上、細部が元の発言と異なる場合があります。 正確な内容は元の動画をご確認ください。

YouTubeで元の動画を見る

スポンサーリンク