ChatGPT Work:音声指示でPC作業を完結させるエージェント機能
OpenAIは、デスクトップ版ChatGPTの進化形「ChatGPT Work」を紹介する動画を公開しました。開発者エクスペリエンス担当のNick Baumann氏が、音声のみで複雑なタスクを依頼し、AIがバックグラウンドで実作業を行う様子を実演します。従来の対話を超え、資料作成やツール操作を自動化する「実行型AI」としての側面が強調されています。
背景
動画内では、従来の音声会話機能に加え、コンピュータ上での具体的なタスク実行能力が備わったことが説明されています。デモンストレーションの画面には2026年7月のカレンダーやGitHub、メモ帳が表示されており、実務環境での利用が前提です。ユーザーが他の作業をしている間に、ChatGPTが接続されたツールを操作して成果物を作り上げるという、並列的なワークフローの実現が背景にあります。
この動画の要点
1. 音声によるタスクの自動実行:ユーザーが「To-doの消化を手伝って」と音声で指示すると、ChatGPTが内容を理解し、具体的な作業を開始します。音声ボタンだけでなくキーボードショートカットからも起動可能で、対話を通じて企画のアイデア出しから実行までをシームレスに行える点が特徴です。
2. バックグラウンドでの並列作業:ChatGPTがスライド作成や画像生成などの重いタスクを実行している間、ユーザーは中断することなく自分のコンピュータで別の作業を続けることができます。AIが「裏方」として実作業をこなし、完了後に結果を報告するという、真のエージェント的な働きを動画では示しています。
3. 外部ツール連携と資料生成:OpenAIのスライドテンプレートや画像生成機能を活用し、指示に基づいたプレゼン資料を自動作成します。動画では「Dev Day」の企画案として、Codexを用いたゲームやカスタムTシャツブースなどのアイデアを反映した、全7枚のビジュアル付きスライドが短時間で完成する様子が描かれています。
4. スマートフォンによるリモート操作:デスクトップアプリのQRコードを読み取ることで、スマートフォンをリモート入力端末として連携させる機能が紹介されています。スマホの音声入力を使ってデスクトップ上のChatGPTに指示を出し、最新のプレゼン資料を画面に呼び出すといったデバイスを跨いだ操作が可能です。
なぜ重要か
「ChatGPT Work」のデモンストレーションが示唆するのは、AIが「検索や相談のツール」から「実務の実行者(エージェント)」へと明確にシフトしたことです。特に注目すべきは、AIが作業している間に人間が別の仕事を進められる「マルチタスクの実現」です。これは単なる時短ではなく、人間のクリエイティビティとAIの実行力を完全に並列化させる新しい労働形態を提示しています。また、スマホをリモートコントローラー化する連携機能は、PCの前に縛られない直感的な操作体系を提案しており、オフィスワークのあり方を根本から変える可能性を秘めています。AIに「任せておく」という信頼関係に基づいたワークフローが、今後の標準になることを予感させる内容です。
こんな人におすすめ
業務効率化を追求するビジネスパーソン、AIエージェントの最新機能を実務に取り入れたい開発者やクリエイター。AIを「使いこなす」段階から「仕事を任せる」段階へ進みたい方に最適です。
見どころ
この記事は OpenAI が公開した動画をAI(Google Gemini)が視聴して 日本語にまとめ、公開前に運営者が内容を確認したうえで掲載しています。 要約の性質上、細部が元の発言と異なる場合があります。 正確な内容は元の動画をご確認ください。
YouTubeで元の動画を見る