Advanced Micro Devices a ajuns la un acord definitiv pentru a achiziționa Taalas, un startup din Toronto care conectează modele de inteligență artificială direct în siliciu, într-o mișcare care vizează accelerarea dramatică a inferenței AI. Acordul, anunțat pe 6 august 2026, vine la doar câteva săptămâni după ce AMD a semnat un acord separat cu Cerebras și semnalează un impuls agresiv de a contesta dominația Nvidia în hardware-ul AI.
Achiziția reflectă cât de repede se schimbă peisajul semiconductorilor, pe măsură ce companiile caută modalități mai ieftine și mai rapide de a rula modele AI. Pentru [acoperirea industriei AI] (https://aibuzzwire.news) în curs de desfășurare a războaielor cu cipuri care remodelează domeniul, AI Buzz Wire urmărește fiecare mișcare majoră.
Ce face Taalas de fapt
Taalas adoptă o abordare neconvențională a așa-numitului perete de memorie - blocajul în care GPU-urile stau inactiv în așteptarea ca datele să sosească din memorie înainte de a putea începe să calculeze numere. În loc să preia greutățile unui model dintr-o bancă de memorie separată, Taalas conectează fizic acele greutăți în tranzistori individuali.
Arhitectura digitală proprietară a startup-ului poate stoca 4 biți de date și poate executa operațiuni matematice folosind un singur tranzistor. Cipul său HC1 prezintă blocuri hardware partajate care precalcula permanent toate cele 16 produse posibile pentru o greutate cuantificată a modelului de 4 biți. Deoarece fiecare rezultat matematic posibil are deja loc live pe cip, tranzistorul individual acționează mai degrabă ca un router fizic decât ca un calculator.
Fiecare greutate specifică a modelului AI este reprezentată de un singur tranzistor Mask ROM. În timpul producției, un strat de metal microscopic este gravat pentru a conecta fizic acel tranzistor la una dintre cele 16 linii de produse precalculate. Când datele circulă prin cip, tranzistorul selectează pur și simplu canalul corect precalculat și transmite rezultatul unui adunator. În esență, circuitul este atât memoria, cât și procesorul combinate.
Rezultatul, potrivit companiei, este uluitor: cipul HC1 poate genera aproximativ 16.000 până la 17.000 de jetoane pe secundă per utilizator. Abordarea amintește de Groq LPU, care coace în mod similar greutățile modelului AI direct în SRAM rapid pe cip pentru a ocoli blocajul memoriei.
The Catch: Un cip construit pentru un model
Compartimentul este semnificativ. Deoarece greutățile modelului sunt gravate fizic în siliciu, fiecare cip Taalas funcționează numai pentru modelul AI specific pentru care a fost proiectat. Nu este un accelerator programabil, de uz general. Asta îl face o propunere fundamental diferită de un GPU, care poate rula orice model încărcat în memoria sa.
Analiștii din industrie au speculat că tehnologia lui Taalas ar putea servi ca un accelerator de decodare dedicat în cadrul sistemelor AMD mai largi la scară de rack - gestionând a doua fază de inferență, sensibilă la latență - în timp ce hardware-ul mai flexibil, cum ar fi sistemul Helios alimentat de Cerebras, se ocupă de faza de pre-umplere. AMD nu a detaliat încă unde se vor introduce cipurile lui Taalas în foaia de parcurs al produsului.
Cine a construit Taalas
Taalas a fost fondată în 2023 de un trio de foști angajați și lideri AMD de la Tenstorrent, producătorul de cipuri AI fondat la Toronto, acum cu sediul în Santa Clara. Echipa fondatoare include CEO-ul Ljubisa Bajic, un co-fondator și fost director executiv, director de tehnologie și președinte al Tenstorrent; COO Lejla Bajic; și CTO Drago Ignjatovic.
Compania a ieșit din stealth în 2024, dezvăluind, printre alții, o finanțare de 50 de milioane de dolari de la Quiet Capital și veteranul investitor în semiconductori Pierre Lamond. La începutul anului 2026, a anunțat încă 169 de milioane de dolari de la un grup care includea Fidelity. Taalas a susținut că poate lansa un nou cip personalizat în doar două luni, în comparație cu un standard industrial care se întinde adesea până la unul sau doi ani și a pariat că poate produce hardware de o mie de ori mai eficient decât omologii bazați pe software.
Condițiile financiare ale achiziției AMD nu au fost dezvăluite. Tranzacția rămâne supusă condițiilor de închidere și aprobării de reglementare.
De ce AMD cumpără acum
AMD l-a descris pe Taalas ca un pionier în siliciul specializat de inferență AI a cărui tehnologie optimizează fluxurile de date de inferență AI și reduce semnificativ blocajele de calcul și memorie asociate arhitecturilor de uz general.
„Tehnologia Taalas și echipa de inginerie de clasă mondială întăresc portofoliul nostru de AI prin furnizarea de performanță și eficiență de inferență diferențiată”, a declarat Vamsi Boppana, vicepreședinte senior AMD al grupului său AI, într-un comunicat de presă.
Acordul extinde un model mai larg. Acordul anterior al AMD cu Cerebras integrează Wafer-Scale Engine al acestuia din urmă în viitorul sistem Helios, care plasează o cantitate enormă de memorie și calculează pe o singură foaie de siliciu interconectată. Adăugarea lui Taalas oferă AMD o a treia armă distinctă în arsenalul său de inferență, alături de propriile GPU-uri Instinct și parteneriatul Cerebras.
Pentru AMD, apelul este clar. Nvidia continuă să domine antrenamentul și inferența AI cu ecosistemul său GPU, iar concurenții s-au luptat să concureze pe calcularea de uz general. Achiziționând companii cu arhitecturi fundamental diferite - motoare la scară wafer, model de siliciu cablat - AMD pariază că hardware-ul specializat va crea nișe profitabile pe care GPU-urile Nvidia unice-fits-all nu le pot servi la fel de eficient.
Piața de inferență în schimbare
Achiziția vorbește și despre o schimbare mai largă a industriei. Pe măsură ce modelele de inteligență artificială cresc și costurile de inferență cresc, economia rulării lor pe GPU-uri de uz general este sub presiune. Cipurile de inferență specializate promit reduceri dramatice ale costurilor pentru implementările de volum mare, unde același model este rulat de milioane de ori.
Dacă AMD poate comercializa cu succes abordarea cablată a lui Taalas, ar putea oferi furnizorilor de cloud și întreprinderilor o modalitate de a rula modele populare la o fracțiune din costul și latența GPU-urilor tradiționale - cu condiția să fie dispuși să se angajeze în siliciul construit în jurul unui singur model.
Rămâneți înaintea războaielor chipurilor
Bătălia pentru supremația hardware-ului AI se intensifică, fiecare achiziție remodelând echilibrul de putere. Urmăriți cele mai recente dezvoltări ale noastre AI pentru scufundări profunde în siliciul care conduce următoarea generație de inteligență.
Citiți mai multe știri AI →