Qualcomms vd säger att de största AI-företagen ber honom om något som nuvarande smartphones inte kan komma i närheten av att göra: att köra 100 miljarder parametrar modeller på själva telefonen, kontinuerligt, senast 2028.

Cristiano Amon talade i en intervju den 8 oktober som rapporterades av Fortune och togs upp den här veckan av butiker inklusive TOKENPOST och Startup Fortune, och sa att flera AI-företag – vars namn han avböjde att ge – driver på för smartphones som kan hålla en modell med 100 miljarder parametrar igång dygnet runt. För läsare som följer övergången av AI från molnet till fickor och handleder är det den tydligaste efterfrågesignalen hittills, och vår AI-hårdvarunyheter spårar var den pushen går härnäst.

Efterfrågan kommer från AI Labs, inte Qualcomms färdplan

Antalet har betydelse på grund av var det kommer ifrån. Amon tillkännagav inte Qualcomms eget produktmål; han vidarebefordrade vad AI-labb säger till världens största mobila chiptillverkare som de vill bygga. Dagens flaggskeppschips toppar långt under den siffran - Snapdragon 8 Elite Extreme Gen 6, Qualcomms högsta mobilplattform, kan köra blandning av expertmodeller över 30 miljarder parametrar på enheten, med ett sammanhangsfönster på ungefär 32 000 tokens.

En modell med 100 miljarder parametrar som körs nonstop är mer än det tredubbla taket, och det förändrar det tekniska problemet i natura, inte bara i grad. Som Startup Fortunes rapport noterar är begäran inte om en större version av assistenten som folk redan använder. Det är för agent AI: programvara som tittar på, resonerar och agerar för en användares räkning istället för att vänta på en prompt, vilket innebär att modellen måste stanna kvar i minnet och fortsätta göra slutsatser i bakgrunden hela dagen utan att laga batteriet eller chassit.

Varför minne är flaskhalsen

Gapet mellan 30 miljarder och 100 miljarder parametrar är i grunden ett minnesproblem. Modellvikter på enheten måste leva i RAM-minne, och tredubbling av parameterantalet samtidigt som slutsatserna körs kontinuerligt multiplicerar minnesbandbredd och effektbehov på ett sätt som nuvarande flaggskeppshårdvara aldrig konstruerats för att absorbera.

Amon erkände att utbudet av minneschips för smartphones är under en "tillfällig begränsning" - samma brist som har drivit upp telefonpriserna i branschen i år - men han formulerade det som ett tryck som kommer att tvinga fram mer minneseffektiva chipdesigner snarare än bara mer minne. Det stämmer med Qualcomms senaste kiselval: 8 Elite Extreme Gen 6 parar sin Hexagon NPU med en ny Element Accelerator och en större delad minnespool specifikt för att hålla latens och strömförbrukning i schack för blandning av experter på enheten.

Chipsen som måste överbrygga gapet

Qualcomms nuvarande flaggskeppsgeneration – Snapdragon 8 Elite Gen 6 och 8 Elite Extreme Gen 6, byggda på en 2nm-process – är avsedd att driva 2027 års flaggskeppstelefoner från Honor, iQOO, Motorola, OnePlus, OPPO, Redmi, RedMagic, vivo och Xiaomi-serien, med de förväntade enheterna i Galaxy S27. Om AI-industrins önskelista för 2028 ska uppfyllas är det denna chipcykel och den efter den som måste leverera minnesarkitekturen, värmen och batterieffektiviteten för att hålla en gränsmodell vid liv i en skjortficka.

Amon sa också, enligt Fortunes rapportering, att Qualcomm arbetar med nästan alla stora AI-aktörer på hemliga hårdvaruprojekt, inklusive enhetskategorier bortom telefoner. Det stämmer överens med företagets senaste hållning att placera Snapdragon-kisel som standardinferensskiktet för edge AI var det än landar – telefoner, bilar, datorer och glasögon.

Vad kontinuerlig AI på enheten faktiskt skulle betyda

Om AI-företag får vad de efterfrågar skulle förändringen vara strukturell snarare än kosmetisk. En modell som körs hela dagen i bakgrunden kan observera sammanhang, förutse behov och agera utan en rundresa till ett datacenter – vilket innebär lägre latens, bättre sekretess och ingen molnkostnad per fråga. Det innebär också telefoner med större, snabbare och mer kraftkrävande minne än dagens flaggskepp har, på en marknad där minnesprissättningen redan är sträckt.

Det finns en sund skepsis att tillämpa här. Chipchefer har gjort djärva AI-förutsägelser på enheten tidigare, och 2028 är tillräckligt långt ute för att påståendet delvis fungerar som en förhandlingsposition med minnesleverantörer, telefontillverkare och AI-labben själva. Men riktningen för begäran är anmärkningsvärd: AI-företag efterfrågar inte snabbare moln-GPU:er den här gången. De efterfrågar en telefon som aldrig slutar tänka.

Oavsett om Qualcomms kunder skickar den enheten 2028 eller senare, är flaskhalsen att titta på inte parametrar – det är minnesbandbredd per watt. Företaget som löser det, i Redmond eller San Diego eller Taipei, kommer att äga nästa definition av en flaggskeppstelefon.

Ligg före AI

Chipkrig, modelllanseringar och avancerade AI-genombrott – täckt utan hypen.

Läs mer AI-nyheter →