Frozen v2: Google entwickelt spezialisierten KI-Chip für Gemini-Effizienz
Google arbeitet an einem neuen, spezialisierten Server-Chip mit der internen Bezeichnung „Frozen v2“. Das primäre Ziel des Chips ist es, die Inferenz-Effizienz der Gemini-Modelle signifikant zu verbessern.
Kernarchitektur und Designprinzip
Der Chip integriert Teile der Gemini-Modellarchitektur direkt in die Hardware. Statt Gewichte und Berechnungen flexibel im Speicher vorzuhalten, werden ausgewählte Modellkomponenten fest in die Silizium-Schaltkreise eingebrannt („baked into the silicon“). Diese feste Verdrahtung reduziert wiederholte Speicherzugriffe und interne Datenbewegungen, was sowohl Latenz als auch Energieverbrauch senkt.
Verhältnis zu bestehenden Systemen
„Frozen v2“ ist nicht als Ersatz für Googles Tensor Processing Units (TPUs) konzipiert. Er bildet eine ergänzende Chip-Familie, die speziell auf die Architektur und die Inferenz-Anforderungen der Gemini-Modelle zugeschnitten ist. Die aktuellen TPUs bleiben für allgemeine KI- und Machine-Learning-Workloads zuständig.
Google-Ingenieure gehen davon aus, dass „Frozen v2“ eine deutliche Effizienzsteigerung gegenüber den neuesten TPUs erreichen kann, gemessen an der Anzahl verarbeiteter Tokens pro Leistungseinheit.
Zeitlicher Horizont und Status
Die geplante Einsatzbereitschaft liegt frühestens im Jahr 2028. Das finale Design und der genaue Umfang der in Hardware integrierten Modellanteile werden derzeit noch von den Ingenieurteams finalisiert.
Ein Sprecher von Google Cloud bestätigte, dass das Unternehmen kontinuierlich an Hardware-Software-Co-Designs arbeitet, um hochoptimierte Systeme zu schaffen. Gleichzeitig wurde klargestellt, dass nicht jedes interne Forschungsprojekt in ein Produkt mündet.
Quelle: TechCrunch AI
FAQ
Was ist der Hauptzweck von Frozen v2?
Der Chip soll die Inferenz der Gemini-Modelle deutlich effizienter machen und damit interne Rechenkapazitätsengpässe mindern.
Wie unterscheidet sich Frozen v2 von den bestehenden TPUs?
Während TPUs für allgemeine KI-Workloads ausgelegt sind, ist Frozen v2 speziell auf die Gemini-Architektur zugeschnitten und integriert Teile des Modells direkt in die Hardware.
Wann wird der Chip voraussichtlich verfügbar sein?
Die Bereitstellung ist frühestens für das Jahr 2028 geplant. Das Design befindet sich noch in der Finalisierungsphase.