Nvidia și AMD au cumpărat în opt luni aceeași idee: cipuri care știu să facă un singur lucru
Un cip care scoate peste 16.000 de cuvinte-fragment pe secundă dintr-un model de inteligență artificială. Pentru comparație: un chatbot obișnuit îți scrie cu câteva zeci pe secundă, atât cât să poți citi pe măsură ce apare textul.
Demonstrația circulă acum pe rețele. Ce nu se spune în clipuri e ce s-a întâmplat cu firma care a făcut cipul — și ce a făcut concurența cu opt luni înainte.
Ce au construit
Taalas, firmă din Toronto fondată în 2023, a ieșit din anonimat în februarie 2026 cu un cip numit HC1. Ideea e simplă de descris și grea de făcut: în loc să pui un model de inteligență artificială să ruleze pe un procesor de uz general, arzi modelul în siliciu. Legăturile dintre elementele de calcul nu se mai programează — se gravează.
Rezultatul, după măsurătorile firmei: peste 16.000 de fragmente de text pe secundă pe modelul Llama 3.1-8B, iar la teste interne în jur de 17.000. Cipul are 815 milimetri pătrați, fabricat la TSMC pe procesul N6, și consumă circa 250 de wați. Costul de operare anunțat: 0,75 cenți la un milion de fragmente.
Prețul plătit pentru viteza asta
Aici e partea pe care demonstrațiile o sar.
HC1 rulează un singur model. Nu două. Llama 3.1-8B, comprimat agresiv. Nu poate rula altceva, nu se poate adapta, nu se poate reprograma decât în limitele unei memorii mici de pe cip. Model nou înseamnă cip nou.
Fondatorul firmei, Ljubisa Bajic, a spus-o el însuși:
„În esență, am căutat moduri de a face compromisuri dureroase la flexibilitate, de dragul economiei și al vitezei.”
Modelul de afaceri care rezultă e ciudat: fabricație nouă în fiecare an, în loc de ciclul de patru ani cu care s-au obișnuit producătorii de plăci grafice. Cipul se învechește când se învechește modelul din el.
Ce s-a întâmplat pe 24 decembrie
În ajunul Crăciunului 2025, Groq — cealaltă firmă americană care făcea cipuri doar pentru rulat modele, nu pentru antrenat — a anunțat un acord de licențiere neexclusivă cu Nvidia.
În aceeași zi au trecut la Nvidia fondatorul Jonathan Ross, președintele Sunny Madra și alți oameni din echipă. Groq a rămas firmă separată, cu un director nou.
Suma nu a fost anunțată de niciuna dintre părți. CNBC a relatat circa 20 de miliarde de dolari, pe o singură sursă — un investitor al Groq. Evaluarea firmei înainte de acord se apropia de 7 miliarde. Cifra celor 20 de miliarde nu e confirmată oficial și trebuie citită ca atare.
Ce s-a întâmplat pe 6 august
La opt luni după, AMD a cumpărat Taalas. Suma nu a fost făcută publică. Tranzacția e încă supusă aprobărilor.
Bajic se întoarce astfel la AMD, unde lucrase înainte să conducă Tenstorrent. Echipa intră în organizația de inteligență artificială condusă de Vamsi Boppana, care a spus doar atât:
„AMD construiește o platformă completă care le dă clienților libertatea de a folosi soluția de calcul potrivită pentru fiecare sarcină.”
De ce contează că amândoi au cumpărat același lucru
Nvidia și AMD nu sunt de acord aproape în nimic. În opt luni, au cumpărat aceeași idee.
Ideea e că munca unui model de inteligență artificială s-a rupt în două. Antrenarea — construirea modelului — are nevoie de mașini care pot face orice, fiindcă nu se știe dinainte ce va fi nevoie. Rularea — răspunsul pe care îl primești când scrii o întrebare — e aceeași operație, de miliarde de ori, și nu are nevoie de flexibilitate. Are nevoie de viteză și de cost mic.
Cincisprezece ani, aceeași piesă de hardware a făcut amândouă lucrurile. Cei doi producători care au construit piesa aia tocmai au plătit ca să nu mai fie așa.
Când doi concurenți ajung independent la aceeași concluzie, nu mai e un pariu. E o constatare.
Ce nu spune articolul ăsta
Nu spune că plăcile grafice dispar. Antrenarea modelelor rămâne pe ele, iar cea mai mare parte din rulare la fel, fiindcă un cip care face un singur model e nefolositor în clipa în care vrei alt model.
Nu spune că cele 16.000 sunt o cifră independentă. E măsurătoarea producătorului, pe modelul lui, comprimat de el. Nimeni din afară nu a verificat-o încă.
Nu spune că cele 20 de miliarde sunt reale. E o cifră relatată de o televiziune pe o sursă, nu un număr confirmat de Nvidia sau de Groq.
Nu spune că te costă pe tine mai puțin. Costul de rulare a scăzut de ani buni și prețul abonamentelor nu a scăzut deloc. Ce se ieftinește la producător nu ajunge automat la client.
Și nu spune cine câștigă. Tranzacția AMD nici măcar nu s-a închis.
Pentru noi, aici
Un lucru merită ținut minte, fiindcă nu e evident.
Dacă rularea unui model ajunge de zece ori mai ieftină, se schimbă cine își permite să folosească unul. Nu marile firme — ele își permiteau și înainte. Se schimbă pentru cel care vrea să pună inteligență artificială într-un produs mic, într-o primărie, într-o școală sau într-o firmă de cinci oameni, și până acum se uita la factură și renunța.
Taalas e la Toronto. Groq, în California. Niciuna nu e la noi și nu va fi. Dar ieftinirea nu se oprește la graniță — se vede în factura oricui construiește ceva.
MCB
Surse: comunicatul oficial AMD din 6 august 2026 privind achiziția Taalas; EE Times, pentru specificațiile cipului HC1, declarațiile lui Ljubisa Bajic și detaliile achiziției; comunicatul Groq din 24 decembrie 2025 privind acordul de licențiere neexclusivă cu Nvidia și trecerea lui Jonathan Ross și Sunny Madra la Nvidia; CNBC, prin David Faber, pentru cifra relatată de aproximativ 20 de miliarde de dolari, citând un investitor al Groq; Constellation Research, pentru evaluarea anterioară a Groq și structura tranzacției.