Google starebbe costruendo un chip con il progetto di Gemini incorporato nel silicio
Un chip server chiamato Frozen v2 integrerebbe nell'hardware la forma di Gemini. Gli ingegneri prevederebbero da sei a dieci volte più output per unità di energia. Google non ha confermato nulla.
Google lavorerebbe a un chip server, nome interno Frozen v2, che costruirebbe nell’hardware parti del progetto del modello Gemini. Secondo notizie riprese questa settimana, gli ingegneri prevedono da sei a dieci volte più output IA per energia rispetto alle TPU attuali, con impiego mirato al 2028. Google non ha confermato che il progetto esista e l’efficienza è una previsione interna, non una misura: va trattata come speranza, non specifica.
La parola interessante è «architettura». Un modello ha l’architettura, cioè il progetto di strati e connessioni, e i pesi, milioni di numeri regolati che gli danno conoscenza. Frozen v2 fisserebbe il progetto, non i numeri: Google potrebbe caricare più tardi un Gemini nuovo e più intelligente sullo stesso chip. Fissare anche i pesi renderebbe il chip obsoleto quando esce un modello migliore. È un compromesso fra velocità e durata utile.
L’efficienza nasce da meno spostamenti. In un chip normale l’esecuzione di un modello muove di continuo dati fra memoria e unità di elaborazione; quel movimento, più della matematica, consuma molta energia. Se il chip sa già la forma del calcolo richiesto, gran parte del rimescolamento sparisce.
Cosa c’è dietro: È la scommessa che le architetture dei modelli si stiano stabilizzando. Per anni cambiavano troppo rapidamente per essere impegnate nel silicio, perché una puce richiede circa tre o quattro anni da progetto a impiego. Scommettere sull’hardware del 2028 significa credere che un modello simile a Gemini lo sarà ancora fra due anni. Il motivo d’impresa è più immediato: Google sarebbe a corto di calcolo interno, tanto che il cloud non serve ogni cliente aziendale interessato. Servire a minor costo vale ora quanto un modello migliore, forse di più.
Cosa significa per te: Nulla oggi e probabilmente nulla nel 2027. La direzione conta perché il costo di eseguire IA determina ciò che ottieni gratis. Ogni grande calo del costo di servizio degli ultimi due anni si è tradotto in taglio di prezzo o piano gratuito più generoso in pochi mesi. Se chip specializzati così funzionano, i modelli buoni smetteranno di essere razionati. La riserva: proiezioni non confermate di ingegneri anonimi su hardware a due anni sono fra le notizie IA meno affidabili; una gamma da sei a dieci volte contiene «trasformativo» e «modesto» insieme.
Fonti
Kimi K3 è diventato troppo popolare: Moonshot sospende i nuovi abbonamenti
Moonshot AI ha smesso di accettare nuovi abbonati a Kimi K3 dopo che la domanda ha portato la capacità di calcolo al limite. Gli utenti esistenti mantengono l'accesso, e la pausa mostra cosa decide davvero la corsa all'IA.