OpenAI Agent Mode、余分なタブなしの自動化を目指す
先月リリースされたOpenAIのエージェントモードは、ユーザーがブラウザの新しいタブを毎回開く代わりに、多段階のタスクを委任できることを目指しています。
今回のアップデートにより、既存のChatGPTインターフェースが拡張され、エージェントがサイトの閲覧、ドキュメントの要約、ミーティングのスケジュール設定、出力のドラフト作成を一連の流れで行えるようになりました。OpenAIは、すべてのアクティビティが1つのウィンドウ内に留まると述べています。
初期テスターは、その promise が紙の上では魅力的だと感じました。中規模ソフトウェア企業のプロダクトマネージャーは、エージェントに競合他社の価格調査、スプレッドシートの作成、スライドデッキの準備を依頼しました。エージェントは最初の2ステップを完了しましたが、ログインページを誤解釈して停止しました。
この事例は、エージェントシステムが依然として複数のポイントで人間によるレビューを必要とすることを示しています。
What the Update Actually Changes
OpenAIのエージェントモードは、モデル呼び出しを連鎖させることで動作します。各ステップは、前の結果とユーザーが提供したコンテキストに基づいて処理されます。ユーザーがアプリケーションを切り替えることなく、ページを開いたり、テキストを抽出したり、計算を実行したり、最終的な成果物を返したりできます。
同社は、エージェントが無関係なタスク間でコンテキストをリセットしてドリフトを低減すると主張しています。また、すべてのアクションをログに記録し、後でユーザーが確認できるようにしています。
複数のレビュアーが営業アウトリーチやミーティング準備でこの機能をテストしました。あるユーザーは、エージェントが3社の公開財務データを正しく取得したものの、別途ログイン認証が必要なペイウォール付きレポートを検知できなかったと報告しています。
これらの結果は、OpenAIが公表している制限と一致しています。エージェントはアカウントへのアクセスや支払いの実行を単独で行うことはできません。
Productivity Gains Come With Oversight Costs
このツールを早期に導入したチームは、ワークロードの変化に気づきました。反復的な検索に費やす時間が減る代わりに、エージェントの出力の修正や情報源の検証に時間を費やすようになりました。
ある消費財ブランドのマーケティングアナリストは、週次の競合スキャンでエージェントを実行したところ、初回は手動ブラウジングを約40分短縮できたと述べています。しかし2回目の実行では、エージェントがライブページではなくキャッシュされたページからデータを取得したため、2025年と2026年の数値が混在したテーブルが生成されました。
アナリストは現在、結果をマネージャーに転送する前にエージェントのログを確認しています。
このパターンはテスター全体で繰り返されています。単純な検索タスクでは成果が見られますが、複数のアカウントを横断したり条件付きロジックを伴うタスクでは、依然として直接的な監督が必要です。
How OpenAI Agent Mode Compares With Existing Tools
すでにいくつかの既存製品が同様の連鎖機能を提供しています。AnthropicのClaude Projectsではファイルを添付して連続したプロンプトを実行でき、Microsoft Copilot in 365では同じスレッド内でOutlookやSharePointからデータを取得できます。
OpenAIのエージェントモードの主な違いは、単一のChatGPTウィンドウ内に留まる点に重点を置いていることです。エージェントは追加の設定なしではZapierやネイティブAPI呼び出しを通じて外部の自動化をトリガーすることはまだできません。
すでに個人向けナレッジ管理にremioを利用しているユーザーは、OpenAIのエージェントが結果を手動で自分のシステムにコピーしない限り、セッション間でメモリを保持しないことに気づいています。一方、remioは追加の手順なしでエピソディックメモリとセマンティックメモリを利用できます。
Risks That Require Attention Now
セキュリティチームは主に2つの懸念を指摘しています。第一に、エージェントはユーザーが許可した任意のパブリックURLにアクセスできるため、隠されたウェブコンテンツを通じたプロンプトインジェクションのリスクが生じます。第二に、ログはデフォルトでOpenAIのクラウドアカウントに保存されるため、規制産業におけるデータ所在地の問題が浮上します。
OpenAIは直接的な金融取引や特定の医療クエリをブロックするガードレールを公開しています。Hugging Faceで公開された独立したレッドチームテストでは、エージェントに同じリクエストを別の言語で言い換えるよう依頼すると、ガードレールが回避可能であることが示されています。
これらの結果を受け、いくつかの企業パイロットではエージェントモードを非機密データのみに制限する動きが出ています。
What to Watch in the Next Three Months
OpenAIは6月のアップデートでGoogle Driveフォルダへの読み取り専用アクセスを追加する予定です。オブザーバーは、この新しいコネクタがタスク完了率を向上させるか、単に検証作業を増やすだけかを注視しています。
AnthropicとGoogleは9月までに同等のエージェント機能をリリースすると予想されています。同一ベンチマークタスクでの失敗率の測定可能な違いが、採用の選択を左右するでしょう。
エンタープライズバイヤーは、OpenAIが監査ログをどのように扱うかも注視しています。SOC 2要件を満たすエクスポート可能なタイムスタンプ付きアクションレコードを追加すれば、規制対象企業が利用を拡大する可能性があります。
自動化オプションを評価するユーザーは、現在のバージョンをChatGPTで直接テストできます。ツール間で永続的な個人メモリを必要とする人は、デフォルトでコンテキストをローカルに保存するremioのようなシステムを引き続き利用しています。



