Els grans laboratoris d'intel·ligència artificial busquen des de fa temps maquinari cada cop més especialitzat per reduir el cost de servir les respostes dels seus models, un objectiu que fins ara Google ha perseguit sobretot amb les seves pròpies unitats de processament tensorial (TPU), pensades per executar qualsevol arquitectura de model dins d'una mateixa família de xips.
Segons ha revelat el mitjà The Information i ha recollit Tom's Hardware, Google treballa en un projecte amb nom en clau "Frozen v2" que gravaria parts de l'arquitectura del model Gemini directament al silici del xip, en lloc de carregar-la en memòria com fan els processadors d'ús general. Els enginyers implicats projecten guanys d'entre sis i deu vegades més testimonis (tokens) processats per watt durant la inferència, respecte a les TPU més recents de la companyia, amb un desplegament previst al voltant del 2028. Un portaveu de Google, preguntat pel projecte, ha declarat que "els equips experimenten amb idees d'alta eficiència i no tots els projectes de laboratori arriben a comercialitzar-se", sense confirmar ni desmentir l'existència de Frozen v2.
La notícia és rellevant perquè, si es confirma, mostraria fins a quin punt Google està disposada a sacrificar flexibilitat de maquinari -un xip dissenyat per a una arquitectura molt concreta té una vida útil limitada si el model canvia substancialment- a canvi d'eficiència, en un moment en què la companyia afronta, segons les mateixes informacions, una manca de capacitat de còmput interna prou greu com per haver hagut de limitar càrregues de treball d'alguns clients del núvol.
Google no ha confirmat oficialment l'existència del projecte Frozen v2 ni cap dels detalls tècnics o de calendari que se li atribueixen, i la informació prové d'un mitjà especialitzat que cita fonts no identificades, no d'un anunci propi de la companyia; tampoc se sap si el projecte arribarà mai a fabricar-se a escala.