CourionAI
IT
Newsletter
← Tutte le notizie
google 2 min di lettura

Google starebbe costruendo un chip con il progetto di Gemini incorporato nel silicio

Un chip server chiamato Frozen v2 integrerebbe nell'hardware la forma di Gemini. Gli ingegneri prevederebbero da sei a dieci volte più output per unità di energia. Google non ha confermato nulla.

Illustrazione in risografia di un grande die di chip visto dall'alto, con un reticolo ripetuto inciso permanentemente nella superficie e piste color corallo che irradiano verso l'esterno

Google lavorerebbe a un chip server, nome interno Frozen v2, che costruirebbe nell’hardware parti del progetto del modello Gemini. Secondo notizie riprese questa settimana, gli ingegneri prevedono da sei a dieci volte più output IA per energia rispetto alle TPU attuali, con impiego mirato al 2028. Google non ha confermato che il progetto esista e l’efficienza è una previsione interna, non una misura: va trattata come speranza, non specifica.

La parola interessante è «architettura». Un modello ha l’architettura, cioè il progetto di strati e connessioni, e i pesi, milioni di numeri regolati che gli danno conoscenza. Frozen v2 fisserebbe il progetto, non i numeri: Google potrebbe caricare più tardi un Gemini nuovo e più intelligente sullo stesso chip. Fissare anche i pesi renderebbe il chip obsoleto quando esce un modello migliore. È un compromesso fra velocità e durata utile.

L’efficienza nasce da meno spostamenti. In un chip normale l’esecuzione di un modello muove di continuo dati fra memoria e unità di elaborazione; quel movimento, più della matematica, consuma molta energia. Se il chip sa già la forma del calcolo richiesto, gran parte del rimescolamento sparisce.

Cosa c’è dietro: È la scommessa che le architetture dei modelli si stiano stabilizzando. Per anni cambiavano troppo rapidamente per essere impegnate nel silicio, perché una puce richiede circa tre o quattro anni da progetto a impiego. Scommettere sull’hardware del 2028 significa credere che un modello simile a Gemini lo sarà ancora fra due anni. Il motivo d’impresa è più immediato: Google sarebbe a corto di calcolo interno, tanto che il cloud non serve ogni cliente aziendale interessato. Servire a minor costo vale ora quanto un modello migliore, forse di più.

Cosa significa per te: Nulla oggi e probabilmente nulla nel 2027. La direzione conta perché il costo di eseguire IA determina ciò che ottieni gratis. Ogni grande calo del costo di servizio degli ultimi due anni si è tradotto in taglio di prezzo o piano gratuito più generoso in pochi mesi. Se chip specializzati così funzionano, i modelli buoni smetteranno di essere razionati. La riserva: proiezioni non confermate di ingegneri anonimi su hardware a due anni sono fra le notizie IA meno affidabili; una gamma da sei a dieci volte contiene «trasformativo» e «modesto» insieme.

Fonti

Fonti: https://the-decoder.com/googles-frozen-v2-chip-reportedly-bakes-geminis-architecture-directly-into-silicon-for-efficiency-gains/

Articolo successivo

Kimi K3 è diventato troppo popolare: Moonshot sospende i nuovi abbonamenti

Moonshot AI ha smesso di accettare nuovi abbonati a Kimi K3 dopo che la domanda ha portato la capacità di calcolo al limite. Gli utenti esistenti mantengono l'accesso, e la pausa mostra cosa decide davvero la corsa all'IA.

Illustrazione in risografia di una barriera di corda che chiude una porta con rack di server dietro, mentre fuori aspetta una lunga fila sinuosa di piccole forme