OpenAI のエージェントである ChatGPT Work は、ユーザーの関与なしで、パスワードで保護された Web サイト アカウントにサインインできるようになりました。また、初回以降はパスワードを確認する必要もありません。今週初めに導入され、ZDNETによって詳しく説明されたこの新機能は、AIエージェントが停止して人間の監視者を待つことを強いる最後の摩擦点の1つを取り除きます。
これは、エージェントの使いやすさにとって有意義な前進です。これは、セキュリティ研究者が 2 年をかけて警告してきたまさに類の機能でもあります。 この件の詳細は、AIの最新動向をご覧ください。
自動サインインの仕組み
この機能をテストしたZDNETのランス・ホイットニー氏によると、この新しいスキルは、ユーザーに代わって複数ステップの割り当てを実行するOpenAIのエージェント製品であるChatGPT Workを通じて利用可能で、ChatGPT ProとPlusの加入者に限定されているという。
仕組みはシンプルです。 ChatGPT が初めて Web サイト アカウントのいずれかにアクセスする必要がある場合、ユーザー名とパスワード、またはパスコードの入力を求められます。手動で入力するか、サードパーティのパスワード マネージャーから自動入力されます。その後、エージェントは通常どおりサインインします。違いは次回の訪問時に現れます。ChatGPT の組み込みブラウザは、従来のブラウザと同様に、セッションを Cookie に保存するため、同じサイトへの以降のサインインは、プロンプトやユーザーの操作なしで自動的に行われます。
事実上、OpenAI は、ブラウザが人間に常に与えてきたものと同じ永続セッション機能をエージェントに与えています。エージェントは、毎回電話をかけなければならないゲストではなくなりました。鍵が付いています。
OpenAI でできること
OpenAI が提案するユースケースは、人々が恐れる退屈で官僚的な Web タスクに大きく依存しています。 ZDNET によると、OpenAI の例としては、新しいアパートにどの公共事業がサービスを提供しているかを把握して適切なプランに申し込むこと、DMV の予約やパスポート更新フォームに記入すること、保険ポータルを通じて X 線検査や血液検査の費用を確認すること、職務内容に適合し、働く意欲のある候補者のプロフィールを見つけることが含まれます。
これらはまさに、エージェント ブラウザが威力を発揮するタスク、つまり、不格好なインターフェイスを備えたサイト間でフォームを繰り返し入力するタスクです。ループからログイン プロンプトを削除することで、これらのシナリオで初めて真の手動による完了が可能になります。
ZDNET のテスト: 速度の上昇はあるものの有望
ホイットニーの実地テストにより、期待と限界の両方が明らかになりました。彼は、独自の組み込みクラウド ブラウザを実行する ChatGPT Windows アプリを使用して、ChatGPT Work に Amazon アカウントにログインし、公開欲しいものリストに商品と価格をリストするよう依頼しました。最初の試行では、予想通り、資格情報の入力を求められました。以降の試行では、ChatGPT は自動的にサインインしました。
しかし、この実験は摩擦にもぶつかった。 ChatGPT Web サイトを通じて試みられた同じタスクは失敗し、Amazon がクラウド ブラウザからの試みをブロックしました。そして、Windows アプリでも、2 回の実行が成功した後、Amazon はアクセスのブロックを開始しました。これは、エージェントを歓迎するかどうかを最終的に決定するのは、OpenAI ではなく宛先サイトであることを思い出させます。アマゾンはブロックに関するコメント要請に応じなかった。
最後の点は、思っている以上に重要です。各サイトは 2 年をかけて、AI スクレイパーやエージェントに対するボット防御を強化してきました。永続的な Cookie はその敵意を和らげるものではありません。サイトは、Cookie を利用したエージェント セッションが信頼できるユーザーであるか、なりすましであるかを評価するため、その情報をより鮮明にする可能性があります。
セキュリティのトレードオフ
AI エージェントにアカウントへの永続的な Cookie ベースのアクセスを許可すると、リスクが集中します。 Cookie はログイン手順を完全にバイパスします。つまり、ユーザーがエージェントが何をしようとしているのかを一時停止して再考する瞬間もバイパスします。 ZDNET の読者へのアドバイスは、「ChatGPT にアクセスを許可するサイトは慎重に決めてください」というものです。
この機能が OpenAI の広範なエージェント プッシュと交差するため、懸念はさらに大きくなります。 Decrypt は、ユーザーに代わってアカウントにサインインする ChatGPT Work に関する不安について報告しており、Tech Times は今週、Gmail Webhook や受信箱ログインなどの新しい ChatGPT Work 自動化機能により、エージェントが操作された場合に新たな攻撃ルートが作成されると報告しました。これとは別に、MacStories は、OpenAI が ChatGPT Work 用のカスタマイズ可能なウィジェットと Codex リモコンを備えた ChatGPT iOS アプリを更新し、エージェントの到達範囲を携帯電話のホーム画面に拡張したと報告しました。
これはいずれも、ユーザーがこの機能を避けるべきであるという意味ではありません。これは、計算方法が変わったことを意味します。ChatGPT Work に保険ポータルを渡すことは、公開ページを閲覧させることとは異なる決定であり、ユーザーはサイトごとにその決定を下す必要があります。
越えられない一線
パスワード プロンプトは、エージェントの設計において常に厄介な成果物であり、自動化されたワークフロー内の人間によるチェックポイントでした。 OpenAI は、Cookie ほど珍しいものを使用してそれを排除できることを示しました。生産性に関する議論は圧倒的であり、先行者がすでにアプローチを標準化しているため、競合するすべてのエージェント スタックにも近いうちに同じ機能が期待されます。
未解決の問題はガバナンスです。 OpenAIによれば、エージェントがアクセスできるサイトはユーザーが制御できるという。ヨーロッパと米国の規制当局は、何百万人もの消費者が、医療データ、政府サービス、金融ポータルなどの機密アカウントへの永続的な認証アクセスをモデルプロバイダーのクラウドブラウザに委任することが何を意味するのか、ようやく検討し始めたところだ。このテクノロジーは今週到着しました。ルールは何年も遅れています。
エージェント AI ツールと、それらがセキュリティと生産性にとって何を意味するかについて詳しくは、AI Buzz Wire のツールの記事をご覧ください。
---
AIの最新情報をお届けAIの最新ニュース、分析、ブレイクスルーを一箇所で。
AIニュースをもっと読む →