Agent OpenAI, ChatGPT Work, może teraz logować się na chronione hasłem konta w witrynach internetowych bez Twojego udziału — i bez konieczności sprawdzania hasła za pierwszym razem. Nowa funkcja, wprowadzona na początku tego tygodnia i szczegółowo opisana przez ZDNET, usuwa jeden z ostatnich punktów tarcia, który zmusił agentów AI do zatrzymania się i czekania na swoich ludzkich nadzorców.
Jest to znaczący krok naprzód w zakresie użyteczności agentów. Jest to również dokładnie ten rodzaj funkcji, przed którym badacze bezpieczeństwa ostrzegali przez dwa lata. Więcej kontekstu na ten temat znajdziesz w naszych trendy AI.
Jak działa automatyczne logowanie
Nowa umiejętność jest dostępna za pośrednictwem ChatGPT Work, agentowego produktu OpenAI, który wykonuje wieloetapowe zadania w imieniu użytkownika i jest dostępna wyłącznie dla abonentów ChatGPT Pro i Plus, twierdzi Lance Whitney z ZDNET, który testował tę funkcję.
Mechanika jest prosta. Gdy ChatGPT po raz pierwszy potrzebuje dostępu do jednego z kont w Twojej witrynie, wyświetla monit o podanie nazwy użytkownika i hasła lub kodu dostępu — wpisanych ręcznie lub automatycznie uzupełnionych przez zewnętrznego menedżera haseł. Następnie agent loguje się normalnie. Różnica pojawia się przy następnej wizycie: wbudowana przeglądarka ChatGPT przechowuje sesję w plikach cookie, tak jak każda konwencjonalna przeglądarka, więc kolejne logowania do tej samej witryny odbywają się automatycznie, bez monitu i interakcji użytkownika.
W efekcie OpenAI zapewniło swojemu agentowi tę samą możliwość utrzymywania trwałych sesji, jaką przeglądarki zawsze zapewniały ludziom. Agent nie jest już gościem, którego trzeba za każdym razem wpuszczać. Posiada klucz.
Co według OpenAI możesz z tym zrobić
Przypadki użycia OpenAI sugerują, że należy w dużym stopniu opierać się na żmudnych, biurokratycznych zadaniach internetowych, których ludzie się boją. Według ZDNET przykłady OpenAI obejmują ustalenie, które media obsługują nowe mieszkanie i zapisanie się do odpowiedniego planu, umówienie się na wizytę w DMV lub wypełnienie formularzy odnowienia paszportu, sprawdzenie kosztów prześwietlenia i badań krwi za pośrednictwem portalu ubezpieczeniowego oraz znalezienie profili kandydatów pasujących do opisu stanowiska i otwartych na pracę.
To właśnie są zadania, w których sprawdzają się przeglądarki agentowe: powtarzalne wypełnianie formularzy w witrynach z nieporadnymi interfejsami. Usunięcie monitu o logowanie z pętli umożliwia po raz pierwszy w tych scenariuszach rzeczywiste ukończenie bez użycia rąk.
Test ZDNET: obiecujący, z progami zwalniającymi
Praktyczne testy Whitney ujawniły zarówno obietnice, jak i ograniczenia. Korzystając z aplikacji ChatGPT dla systemu Windows, która obsługuje własną wbudowaną przeglądarkę w chmurze, poprosił ChatGPT Work o zalogowanie się na jego konto Amazon i wyświetlenie artykułów i cen na jego publicznej liście życzeń. Pierwsza próba skłoniła go do podania referencji, zgodnie z oczekiwaniami. Przy kolejnych próbach ChatGPT logował się automatycznie.
Ale w eksperymencie doszło również do tarcia. Próba wykonania tego samego zadania za pośrednictwem witryny ChatGPT nie powiodła się, a Amazon zablokował próbę z przeglądarki w chmurze. Nawet w aplikacji dla systemu Windows po dwóch udanych uruchomieniach Amazon zaczął blokować dostęp — co przypomina, że to witryny docelowe, a nie OpenAI, ostatecznie decydują, czy agenci są mile widziani. Amazon nie odpowiedział na prośbę o komentarz w sprawie blokad.
Ten ostatni punkt ma większe znaczenie, niż mogłoby się wydawać. Witryny spędziły dwa lata na ulepszaniu ochrony botów przed skrobakami i agentami AI. Trwałe pliki cookie nie złagodzą tej wrogości; mogą to zaostrzyć, ponieważ witryny oceniają, czy sesja agenta oparta na plikach cookie jest zaufanym użytkownikiem, czy osobą podszywającą się.
Kompromis w zakresie bezpieczeństwa
Przyznanie agentowi AI trwałego dostępu opartego na plikach cookie do Twoich kont koncentruje ryzyko. Pliki cookie całkowicie omijają etap logowania, co oznacza, że pomijają także moment, w którym użytkownik może się zatrzymać i ponownie rozważyć, co zamierza zrobić agent. ZDNET radzi czytelnikom ostrożność: rozważnie wybieraj strony, na które pozwalasz ChatGPT na dostęp.
Zaniepokojenie pogłębia się, gdy ta funkcja krzyżuje się z szerszym naciskiem na agentów OpenAI. Firma Decrypt zgłosiła niepokój związany z logowaniem się na konta ChatGPT Work w imieniu użytkownika, a Tech Times poinformował w tym tygodniu, że nowe funkcje automatyzacji ChatGPT Work, w tym webhooki Gmaila i logowanie do skrzynki odbiorczej, tworzą nowe drogi ataku w przypadku manipulacji agentem. Osobno MacStories poinformowało, że OpenAI zaktualizowało aplikację ChatGPT na iOS o konfigurowalne widżety dla ChatGPT Work i pilota Codex, rozszerzając zasięg agenta na ekran główny telefonu.
Nic z tego nie oznacza, że użytkownicy powinni unikać tej funkcji. Oznacza to, że zmienił się rachunek: przekazanie ChatGPT Work portalowi ubezpieczeniowemu to inna decyzja niż pozwolenie mu na przeglądanie stron publicznych, a użytkownicy muszą teraz podejmować tę decyzję strona po witrynie.
Przekroczona linia, której nie można przekroczyć
Pytanie o hasło zawsze było niezręcznym artefaktem w projektowaniu agentów — ludzkim punktem kontrolnym w zautomatyzowanym przepływie pracy. OpenAI pokazało, że można to zaprojektować za pomocą niczego bardziej egzotycznego niż pliki cookie. Wkrótce możesz spodziewać się tych samych możliwości od każdego konkurencyjnego stosu agentów, ponieważ argument dotyczący produktywności jest przytłaczający, a pierwszy gracz już znormalizował podejście.
Otwartą kwestią jest zarządzanie. OpenAI twierdzi, że użytkownicy kontrolują, do których witryn agent może uzyskać dostęp. Organy regulacyjne w Europie i USA dopiero zaczynają zastanawiać się, co to znaczy, gdy miliony konsumentów przekazują stały, uwierzytelniony dostęp do wrażliwych kont – danych dotyczących zdrowia, usług rządowych, portali finansowych – przeglądarce w chmurze dostawcy modelu. Technologia pojawiła się w tym tygodniu. Przepisy są spóźnione o lata.
Więcej informacji na temat agentycznych narzędzi AI oraz ich znaczenia dla bezpieczeństwa i produktywności można znaleźć w omówieniu narzędzi AI Buzz Wire.
---
Bądź na Bieżąco z AINajnowsze wiadomości, analizy i przełomy w dziedzinie AI — wszystko w jednym miejscu.
Czytaj więcej wiadomości AI →