Gemini-Architektur direkt in Silizium implementiert: Technische Details zu Googles neuem KI-Inferenzchip „Frozen v2“ enthüllt, Rechenleistung pro Einheit des Stromverbrauchs um bis zu das 10-Fache gesteigert
TradingKey – Laut einem Bericht von The Information, der sich auf zwei mit der Angelegenheit vertraute Personen beruft, entwickelt Google (GOOGL) einen neuen Server-Chip, der die zugrunde liegende Architektur des Gemini-Modells direkt in die Chip-Hardware einbetten kann, um die operative Effizienz von KI-Diensten für Nutzer signifikant zu steigern. Dieser KI-Inferenzchip mit dem internen Codenamen „Frozen v2“ adressiert direkt den derzeitigen gravierenden Mangel an KI-Rechenleistung bei Google. Quellen zufolge hat die Kapazitätslücke bei der Rechenleistung interne Ressourcenkonflikte ausgelöst und Google Cloud sogar dazu gezwungen, zahlreiche Aufträge externer Kunden abzulehnen. Das Forschungs- und Entwicklungsteam schätzt, dass nach dem offiziellen Einsatz des Chips die Anzahl der pro Energieeinheit verarbeiteten Token das 6- bis 10-fache der neuesten Generation der bestehenden, eigenentwickelten KI-Chips von Google betragen wird.