National Security Agency spenderar miljarder dollar i år på att testa avancerade AI-modeller, med datorkraft som driver det mesta av kostnaden, enligt sekretessbelagda uppskattningar som beskrivits för kongressen.
Washington Sun rapporterade siffrorna, med hänvisning till två källor som är bekanta med de hemliga uppskattningarna. Avslöjandet har skärpt en debatt om Capitol Hill om vem som ska betala för tillsyn av alltmer kapabla AI-system - och hur dyrt seriös granskning av regeringen har blivit.
För pågående täckning av AI-tillsyn och reglering, se de senaste AI-policynyheterna.
Beräkna är den största räkningen
Enligt en av källorna som citeras av The Washington Sun är datorkraft den enskilt största kostnaden i NSA:s AI-testning. Personalkostnaderna läggs till det totala, eftersom byrån måste konkurrera med lönepaketen som erbjuds av frontier AI-labb för en liten pool av experter som kan utvärdera banbrytande modeller.
De inblandade summorna drar till sig uppmärksamhet eftersom tidigare offentliga uppskattningar av statlig AI-tillsyn var dramatiskt lägre. Congressional Budget Office fastställde kostnaden för ett tvåpartiskt lagförslag för att skapa ett centrum för AI-risker till ungefär 20 miljoner dollar per år. Lagstiftare förväntar sig nu att fullskalig AI-övervakning kan kosta tiotals miljarder dollar årligen, enligt källorna.
Varför det kostar så mycket att testa Frontier-modeller
Ekonomin för AI-testning speglar ekonomin med att använda AI i stor skala. Konsumentprenumerationer på AI-produkter är kraftigt subventionerade: analysföretaget SemiAnalysis har uppskattat att ett maxbelopp på $200 per månad ChatGPT Pro-prenumeration är värt upp till $14 000 till API-listpriser, medan Anthropics liknande prissatta Claude Max-plan är värd upp till ungefär $8 000.
Företags- och statliga kunder betalar däremot närmare de verkliga kostnaderna. OpenAI har flyttat nya företagskontrakt till tokenbaserad fakturering, och på Anthropic kommer uppskattningsvis 75 till 85 procent av intäkterna från användningsbaserade kontrakt, per SemiAnalysis. Agentiska arbetsflöden – precis den typ av självständiga beteendesäkerhetstestare som de flesta behöver undersöka – kan konsumera upp till tusen gånger fler tokens än en vanlig chattkonversation.
Leverantörer experimenterar med sätt att tämja dessa kostnader för stora kunder. Enligt The Information låter OpenAI nu vissa stora kunder betala endast för slutförda uppgifter snarare än råa tokens, och har introducerat GPT-6 Sol och Luna, två modeller som kostar hälften av den vanliga API-hastigheten. Men dessa rabatter gäller inte för de mest kraftfulla gränssystemen, som fortfarande är de dyraste att driva – och leverantörer lägger alltmer in sina mest kapabla modeller bakom slutna cybersäkerhetsprogram, vilket lägger till ytterligare ett lager av kostnad och komplexitet för alla utomstående utvärderare.
Utgiftstrycket går i båda riktningarna. Financial Times har rapporterat att OpenAI planerar att spendera cirka 856 miljarder dollar på datorkraft fram till 2030, medan Anthropic förbereder sig för en börsintroduktion som förväntas senast i november. SemiAnalysis uppskattar att bruttomarginalen på Anthropics API-verksamhet överstiger 80 procent – marginaler som hjälper till att finansiera gränsutvecklingsloppet som NSA nu försöker utvärdera självständigt.
Vem betalar för tillsyn?
Frågan om finansiering har redan delat upp sig i konkurrerande förslag. Nat Purser från AI Verification and Evaluation Research Institute har föreslagit en avgift på AI-utvecklare som skulle hjälpa till att finansiera oberoende statliga tester – ett tillvägagångssätt som skulle formalisera vad industrin redan gör frivilligt.
Noterbart rapporterade The Washington Sun att Anthropic och OpenAI har signalerat att de kan vara villiga att betala för utökad statlig tillsyn. Den ståndpunkten överensstämmer med båda företagens offentliga stöd för tredje parts säkerhetsutvärderingar och skulle sprida kostnaderna över branschen snarare än att koncentrera dem i den federala budgeten.
Det bredare övervakningslandskapet
NSA:s utgiftsavslöjande landar mitt i en bredare omstrukturering av hur den amerikanska regeringen utvärderar AI-system. Byrån har tidigare förespråkat för frivillig testning av tillgång till kommersiella modeller, och nationella säkerhetsbyråer har blivit allt mer centrala i AI-politiken när gränssystem får cyber- och biologiska möjligheter som tillsynsmyndigheter kämpar för att bedöma oberoende.
Prislappen illustrerar också en obekväm verklighet för beslutsfattare: kostnaden för meningsfull tillsyn skalar med kostnaden för de system som granskas. En budget byggd för 20 miljoner dollar om året är dåligt utrustad för modeller vars tränings- och utvärderingskörningar kostar hundratals miljoner dollar vardera.
När kongressen överväger omauktorisering av AI-tillsynsprogram ger de sekretessbelagda uppskattningarna lagstiftare en konkret – och nykter – datapunkt om vad seriös utvärdering faktiskt kostar.
Ligg före AI
Statliga utgifter för AI-tillsyn kommer att bli en av de avgörande politiska striderna för det kommande året. För fler brytande AI-nyheter, från reglering till lanseringar av gränsmodeller, följ AI Buzz Wire.
Läs mer AI-nyheter →