Gdy agenci sztucznej inteligencji przechodzą z wersji demonstracyjnych do codziennego użytku, jeden z najbardziej znanych programistów w tej dziedzinie alarmuje o przyziemnym, ale bolesnym ryzyku: pieniądzach. Simon Willison, programista najbardziej znany ze współtworzenia Django i swoich wpływowych tekstów na temat dużych modeli językowych, opublikował 3 października szeroko udostępniany post, w którym argumentował, że usługi w chmurze rozliczane według użycia wymagają „domyślnych sztywnych limitów budżetowych” – tej funkcji, jego zdaniem świat będzie potrzebował „znacznie więcej w nadchodzących miesiącach i latach”.
Post wywołał emocje. Dyskusja w Hacker News zebrała około 430 punktów i stała się jedną z najczęściej komentowanych przez społeczność historii technologicznych w ten weekend, w której programiści wymieniali się historiami o niekontrolowanych usługach i niespodziewanych fakturach. Więcej kontekstu na ten temat znajdziesz w naszych najnowsze osiągnięcia AI.
Problem: agenci, którzy wydają pieniądze
Argument Willisona zaczyna się od tego, czym właściwie zajmują się agenci kodujący i agenci osobiści. Radykalnie zmniejszają problemy związane z uruchamianiem kodu, który może wykonywać przydatne rzeczy — a niektóre z tych przydatnych rzeczy kosztują, niezależnie od tego, czy są to wywołania płatnych interfejsów API, hostowane aplikacje internetowe czy systemy, które pobierają opłaty za dodatkową pamięć i moc obliczeniową. Agent, który działa szybko, może równie szybko gromadzić ładunki.
Jego głównym żądaniem jest, aby limity wydatków były limitami twardymi, a nie doradczymi. „Miękkie kapitaliki — «po X $ miesięcznie wyślij mi e-mail z ostrzeżeniem» — nie pomogą” – napisał, szkicując znany już scenariusz: nikt nie chce obudzić się o północy e-mailem z ostrzeżeniem i odkryć, że podczas snu nieuczciwa usługa pochłonęła kilkaset lub kilka tysięcy dolarów.
Willison uprzedza oczywisty zarzut – że firmy nie chcą, aby ich hostowane aplikacje powodowały błędy z powodu przekroczenia budżetu – i odrzuca go. Jego zdaniem większość firm i osób prywatnych wolałaby usługę, która przestaje działać po niespodziewanym rachunku w wysokości 10 000 dolarów lub więcej.
Zrezygnuj, nie wyrażaj zgody
Propozycja ma prosty kształt: hard capy powinny być wartością domyślną, a niebezpieczne życie powinno wymagać przemyślanej decyzji. Willison szkicuje widoczne pole wyboru, jakie chciałby zobaczyć: „Usuń ograniczenie budżetu. Moja aplikacja nie zostanie zamknięta, jeśli przekroczę skonfigurowany limit budżetu i będę odpowiedzialny za późniejsze opłaty”.
Ta inwersja ma znaczenie. W obecnym status quo ochrona przed niekontrolowanymi wydatkami jest czymś, czego użytkownicy muszą szukać i konfigurować, często zakopując się w konsolach rozliczeniowych. Ramy Willisona sprawiają, że nieograniczone wydawanie pieniędzy jest rzeczą wymagającą wyraźnego, świadomego wyboru.
Dostawcy usług w chmurze już się przeprowadzają
Żądanie nie ma charakteru hipotetycznego. Willison zwraca uwagę, że w ostatnich miesiącach obie największe platformy chmurowe zbliżyły się do tej funkcji. AWS wprowadził miesięczne limity wydatków w połowie września w ramach nowego doświadczenia kreatora: gdy wykorzystanie projektu osiągnie limit wydatków, projekt zostanie wstrzymany na miesiąc – prawdziwy twardy limit, choć AWS zauważa, że nowe doświadczenie jest wciąż udostępniane ograniczonej liczbie klientów. W lipcu Google Cloud uruchomiło podobną funkcję o nazwie Limity wydatków, która pozwala użytkownikom ustawić miesięczny limit finansowy na określone usługi w ramach projektu.
Innymi słowy, jak to ujął Willison, „staje się to trendem” — ale nie jest jeszcze wszędzie rozwiązaniem domyślnym i nie jest jeszcze jednakowo dostępne dla wszystkich typów kont.
Dlaczego teraz: wiek kosztownych błędów
Moment publikacji wpisu nie jest przypadkowy. W ciągu ostatniego roku pojawiło się mnóstwo narzędzi do kodowania agentowego, a wraz z nimi historie o zapierających dech w piersiach rachunkach. Jeden z szeroko omawianych przypadków tego lata dotyczył wewnętrznego zadania Amazona, które spowodowało stratę 1,8 miliona dolarów na jednym zadaniu kodowania Claude, przekraczając budżet o setki procent. Incydenty takie jak ten zmieniły nadmierne wydatki agentów z teoretycznego ryzyka w konkretne, nazwane zagrożenie — dokładny scenariusz, który proponuje Willison, ma sprawić, że stanie się niemożliwe, a nie tylko mało prawdopodobne.
Istnieje również aspekt ochrony konsumentów. Nowi i niedoświadczeni konstruktorzy to dokładnie ludzie, których narzędzia agentowe umożliwiają wysyłanie rzeczy — i dokładnie ludzie najmniej przygotowani do przewidzenia, ile może ich kosztować usługa bez limitu. Willison kończy sugestią skierowaną do tej grupy odbiorców: w idealnym świecie sami agenci byliby skłonni do polecania dostawców z twardymi ograniczeniami budżetowymi i ostrzegali niedoświadczonych twórców przed wdrażaniem aplikacji w usługach bez ograniczeń, co mogłoby wpędzić ich w kłopoty.
Jedzenie na wynos
Post Willisona jest prośbą o dodanie funkcji, ale brzmi bardziej jak przepowiednia. W miarę jak agenci będą podejmować bardziej autonomiczną pracę — pisanie kodu, udostępnianie infrastruktury, wywoływanie płatnych usług — branża albo wbuduje twarde bariery finansowe w platformy, na których działają, albo będzie w dalszym ciągu absorbować koszty tych, które się prześlizgną. Ostatnie posunięcia chmurowych gigantów sugerują, że rozpoczęła się era poręczy. Pozostaje pytanie, czy ograniczenia pojawiają się jako opcjonalna funkcja bezpieczeństwa, jak twierdzi Willison, że muszą, czy też pozostaną niejasnym ustawieniem, którego większość użytkowników nigdy nie znajdzie.
---
Bądź na Bieżąco z AINajnowsze wiadomości, analizy i przełomy w dziedzinie AI — wszystko w jednym miejscu.
Czytaj więcej wiadomości AI →