Google ka filluar të zhvillojë një procesor të projektuar ekskluzivisht për modelet e saj Gemini AI . Projekti, i njohur në mënyrë të brendshme si Frozen v2 , synon të integrojë një pjesë të arkitekturës së modelit direkt në silikon, një strategji që premton të zvogëlojë në mënyrë drastike konsumin e energjisë dhe të përshpejtojë përgjigjet e sistemit.
Sipas informacionit të rrjedhur në The Information dhe të raportuar nga disa media, çipi i ri mund të përpunojë gjashtë deri në dhjetë herë më shumë tokena për vat sesa TPU-të aktuale të Google. Kompania nuk e ka konfirmuar zyrtarisht projektin, por planet tregojnë për një lançim të mundshëm duke filluar nga viti 2028, me kusht që të kalojë fazën aktuale të vlerësimit.
Një çip i projektuar posaçërisht për Gemini

Ndryshe nga TPU-të konvencionale, të cilat mund të ekzekutojnë modele të ndryshme dhe kërkojnë lëvizjen e sasive të mëdha të të dhënave, Frozen v2 përfshin në transistorë vendime të caktuara strukturore specifike për Gemini. Kjo zvogëlon numrin e operacioneve të kërkuara gjatë nxjerrjes së përfundimeve, domethënë kur modeli i trajnuar gjeneron përgjigje. Rezultati është kohë më e shpejtë përgjigjeje dhe konsum më i ulët energjie , dy faktorë kritikë në qendrat e të dhënave të sotme.
Dizajni origjinal, i udhëhequr nga shkencëtari kryesor i Google DeepMind, Jeff Dean, parashikonte integrimin direkt të peshave të modelit në çip. Megjithatë, ky opsion do ta kishte bërë harduerin të vjetëruar pas përditësimeve të modelit. Google zgjodhi në vend të kësaj të mbante peshat e përditësueshme nga softueri dhe të bllokonte vetëm një pjesë të arkitekturës. Në këtë mënyrë, Frozen v2 mund të përdoret me versione të ndryshme Gemini për sa kohë që ato ndajnë një arkitekturë të përbashkët. Kompania ende po vendos se çfarë përqindjeje të modelit do të jetë e bllokuar në silikon.
Efikasitet dhe kursim energjie

Vlerësimet e brendshme tregojnë se Frozen v2 mund të jetë gjashtë deri në dhjetë herë më efikas se gjenerata e fundit e TPU-ve të Google-it për sa i përket tokenëve të gjeneruar për vat. Kjo përfaqëson një përparim të rëndësishëm në një kohë kur kostoja e energjisë së inteligjencës artificiale është bërë një nga sfidat kryesore të industrisë. Ulja e konsumit të energjisë për pyetje do t'i lejonte Google-it të trajtojë më shumë kërkesa pa pasur nevojë të zgjerojë në mënyrë proporcionale infrastrukturën e saj.
Prodhimi i planifikuar i Frozen v2 do të jetë shumë më i ulët se ai i TPU-ve tradicionale. Google e konsideron këtë gjeneratë një provë për të vlerësuar masën në të cilën ia vlen të kalohet drejt çipave të lidhur më ngushtë me modele specifike. Çipi do të bashkëjetojë me TPU-të e gjeneratës së tetë, të cilat tashmë janë të ndara në variante të veçanta për trajnim dhe nxjerrje përfundimesh. Qëllimi nuk është të zëvendësohet e gjithë familja TPU , por të krijohet një zgjidhje më e specializuar për ngarkesa të caktuara pune Gemini, veçanërisht në shërbimet ku vëllimi i pyetjeve dhe kostoja e energjisë janë faktorë kritikë.
Presioni mbi infrastrukturën e Google-it

Zhvillimi i Frozen v2 adreson gjithashtu një nevojë urgjente. Sipas raporteve të publikuara, Google Cloud madje është detyruar të refuzojë kontratat me klientë të jashtëm për shkak të mungesës së kapacitetit të disponueshëm informatik. Kërkesa për shërbime të inteligjencës artificiale është rritur aq shpejt sa kompania është detyruar të përparësojë burimet midis produkteve të veta dhe atyre të klientëve të saj. Një çip më efikas do të lejonte zgjerimin e kapacitetit të përdorshëm të qendrave të të dhënave pa u mbështetur vetëm në instalime të reja.
Strategjia e Google nuk është një rast i izoluar. OpenAI po punon me çipat e vet me Broadcom, Meta po zhvillon përshpejtues të brendshëm dhe NVIDIA ka licencuar teknologji nga Groq. Trendi drejt pajisjeve të specializuara për modele specifike po përshpejtohet dhe Frozen v2 përshtatet në këtë lëvizje. Integrimi midis pajisjeve dhe softuerëve është një nga avantazhet kryesore konkurruese të Google , pasi ajo projekton si modelet Gemini ashtu edhe procesorët me të cilët ato funksionojnë.
Projekti Frozen v2 përfaqëson një hap tjetër në angazhimin e Google për të optimizuar infrastrukturën e saj të inteligjencës artificiale. Nëse parashikimet janë të vërteta, çipi mund të ofrojë deri në dhjetëfish përmirësim në efikasitet , gjë që do të rriste rentabilitetin e shërbimeve si Gemini dhe do të lehtësonte presionin mbi Google Cloud. Edhe pse ende në fazën e zhvillimit dhe pa konfirmim zyrtar, iniciativa pasqyron rëndësinë që kompania i kushton specializimit të pajisjeve si një faktor dallues kundrejt konkurrentëve si OpenAI, Microsoft dhe Meta. Gjithçka sugjeron që, nëse arrin prodhimin në vitin 2028, Frozen v2 do të shënojë një pikë kthese në mënyrën se si modelet e IA-së funksionojnë në shkallë të gjerë.