- Google'ın, Gemini'nin mimarisinin bir kısmını silikona gömülü olarak çalıştıran Frozen v2 adlı bir sunucu çipi geliştirdiği belirtiliyor.
- Raporlara göre mühendisler, mevcut TPU'lara kıyasla 6 ila 10 kat daha verimli bir çip öngörüyor ve çipin 2028'de devreye alınması planlanıyor.
- Haberin ardından Alphabet hisseleri Pazartesi seansında yaklaşık %3 yükseldi. Şirket, 22 Temmuz Çarşamba günü 2026'nın ikinci çeyrek bilançosunu açıklayacak.
Google, tek bir iş için tasarlanmış bir çip üzerinde çalışıyor: Gemini'yi daha hızlı ve daha ucuz çalıştırmak.
Frozen v2 kod adlı çip, Pazartesi günü The Information tarafından haberleştirildi ve Google'ın, mevcut talebi karşılamakta zorlandığı bir soruna potansiyel bir çözüm sunuyor: Şirket, yarattığı yapay zeka talebine yetişmekte zorlanıyor.
Mart ayında Google, Meta'ya istediği Gemini bilgi işlem hacmini karşılayamayacağını söyledi. Meta, çalışanlarına yapay zeka kullanımını sınırlamaları talimatını vermek zorunda kaldı. Bu yıl yapay zeka altyapısına 190 milyar dolara kadar harcama yapan Google, yeterli sunucusu olmadığı için müşterileri geri çeviriyordu.
Bu nedenle şimdi yalnızca kendi yapay zeka modelleri için tasarlanmış bir çip inşa ediyor.
Yeni çip hakkında fazla bilgi bulunmuyor ancak isimlendirme geleneğine bakılırsa bu, Google'ın 2015'ten beri geliştirdiği ve Gemini ile harici geliştiricilere yönelik Cloud hizmetlerini çalıştıran özel TPU yongalarının bir yükseltmesi değil.
Bu Tensor çipleri, üzerlerine yüklenen herhangi bir yapay zeka modelini çalıştırabiliyor. Frozen v2 ise farklı bir iş yapıyor. Raporlara göre çip, Gemini'nin mimarisinin bir kısmını—modelin bilgiyi nasıl yönlendirdiğini ve işlediğini belirleyen yapısal planı—doğrudan donanıma gömüyor.
Makine öğreniminde "dondurma", bir şeyi kalıcı olarak sabitlemek anlamına gelir. Burada dondurulan şey, modelin ağırlıkları değil (Gemini'nin eğitim sırasında edindiği ve güncellenebilir kalan bilgisi), mimaridir. Bu planı çipin devrelerine gömerek çip, gereksiz hesaplamaları atlıyor ve her sorguda verileri bellek üzerinde taşımaktan kurtuluyor. Mühendisler, tüketilen her watt elektrik başına üretilen token sayısında (her yapay zeka yanıtını oluşturan küçük metin parçaları) 6 ila 10 kat iyileşme öngörüyor.
Bu, Google'ın tek sorgunun güç maliyetiyle on sorgu sunması arasındaki fark.
Gemini'yi kullanıyorsanız, Frozen v2 size nasıl hissettirdiğini değiştirmeyecek. Ancak çalıştırma maliyetini değiştirecek—ve daha ucuz çalışan Gemini, OpenAI, Anthropic ve ABD'li şirketlerin yapay zeka token kullanımının %45'ine kadarını oluşturan Çin laboratuvarlarıyla daha iyi rekabet edebilecek. Muhtemelen daha ucuz yapay zeka görmeyebilirsiniz, ancak Google muhtemelen daha karlı olacak.
Haber üzerine Alphabet hisseleri Pazartesi seansında yaklaşık %3 yükselişle gün içi 356 dolara ulaştı. Şirket, 22 Temmuz Çarşamba günü 2026'nın ikinci çeyrek kazançlarını açıklayacak. Yatırımcıların Google'ın en son sonuçlarını beklemesiyle birlikte yükseliş bugünkü seansta geriledi.
Bu, büyük bir yapay zeka şirketinin ürünlerini geliştirmek için Nvidia donanımına olan aşırı bağımlılığını sona erdirmeye yönelik bir başka çabası. Nvidia, yapay zeka için GPU pazarının yaklaşık %85'ini kontrol ediyor ve her büyük teknoloji şirketi bundan kurtulmak istiyor.
Nvidia'nın donanımı aslında video oyunları için tasarlanmıştı, dil modelleri için değil—çalışıyor, ancak özel amaçlı çiplerin taşımadığı ek yüklerle birlikte. Google'ın ölçeğinde 6-10 kat verimlilik farkı soyut bir kavram değil. Bu, milyarlarca dolar anlamına geliyor. Meta, Amazon, Microsoft ve OpenAI'in tam da bu nedenle özel silikon programları var.
Decrypt'in Mart ayında bildirdiği gibi, 2027'ye kadar 1 milyon Nvidia GPU'su dağıtma taahhüdünde bulunan AWS bile bu uzun vadeli maruziyeti azaltmak için eş zamanlı olarak kendi çiplerini geliştiriyor.
Frozen v2 henüz araştırma aşamasında. Temel tasarım kararları kesinleşmiş değil, Google projenin varlığını doğrulamadı ve çip harici Cloud müşterilerine sunulmayacak—tek bir modele göre donanımlandırılmış bir donanım başka bir modeli çalıştıramaz. Raporlara göre, en erken 2028'de devreye alınması hedefleniyor.
Bu arada Google, köprü çözüm olarak xAI'nin veri merkezlerinden 110.000 Nvidia GPU'su kiralamak için SpaceX'e ayda 920 milyon dolar ödüyor.