Hexcore okuyucuları için heyecan verici bir bakış sundukları Nvidia mühendisliği laboratuvarına derken, teknoloji dünyasının en büyük dönüm noktalarından biri olan yapay zeka platformunu yakından takip ettik. Şirket, genel kamuoyuna henüz açılmamış ancak üzerinde çalışmaların yoğunlaştığı dört farklı konumda yer alan özel araştırma merkezlerinde Nvidia'nın yenilikçi donanımlarını sergiliyor.
Bu turda odağımız, yeni nesil ve yapay zeka asistanlarını (agentic AI) destekleyecek dev platformunun kalbi olan Vera Rubin NVL72 rafları oldu. Bu sistemler sadece teorik projelerden ibaret değil; sahne üzerinde parçaları dizilmiş bir prototip olmaktan çıkıp, gerçek bir veri merkezinde, bizzat OpenAI gibi öncü şirketlerin iş yüklerini taşıyan canlı bir çalışma ortamı olarak bizlerle buldu.
Engineering SuperLab: Mühendisler İçin Tasarlandı
Nvidia'nın bu özel alanlarına 'Engineering SuperLab' adını veriyor. Burası standart, resmi bir veri merkezi görünümünden uzakta; daha çok mühendislerin hızlıca yeni donanımları kurup test etmesine olanak tanıyan dinamik ve deneysel bir ortam olarak kurgulanmış durumda. Bu lablar, Nvidia gibi dev bir teknoloji devi için temel tasarım unsurlarının sürekli güncellendiği laboratuvarlardır. Merdivenleri hızla değiştirilebilen raflar aracılığıyla mühendisler, yeni parçaların performansını gerçek yükler altında gözlemlemektedir.
Vera Rubin ve NVL72 Mimarisi Şifreleri
Vera Rubin, Nvidia'nın en güncel çiplerinden biri olarak yapay zeka donanımına büyük bir soluk getiriyor. Gözlemlediğimiz her NVL72 rafı 18 adet hesaplama tepsisinden oluşuyor ve bu sistemi tek bir dev sistem gibi çalıştıran 9 adet NVLink geçiş (switch) tepsisiyle destekleniyor. Bu mimari, gücü birleştirilmiş tek bir yapay zeka platformu olarak hizmet vermesine olanak sağlıyor.
Bir NVL72 rafı üzerinde bulunan her hesaplama tepsisi önden çift ConnectX-9 ağ kartlarına ve ortada yer alan Bluefield-4 DPU'ya sahip bağlantı noktalarına sahipti. Arka kısımları ise sistemin omurgasını oluşturan Nvidia'nın altı nesil NVLink spine (omurga birleştirme hattı) tarafından sarılmıştı. Bu karmaşık ama akıl almaz devre, GPU başına 3,6 TB/s bant genişliğine kadar ulaşıyor ve toplamda raf bazında 260 TB/s ölçek büyütme bant genişliği sunuyor.
Bu sistemlerin iş yapısının merkezinde ise MGX NVL tasarımı bulunuyor. Bu referans raf ünitesi 72 Rubin GPU'yu ve 36 Vera CPU'yu barındırarak, toplamda 256 GPU’ya kadar çıkabilen dev bir ölçek büyütme (scale-out) sistemi sunabiliyor.
Sıvı Soğutmanın Yeni Standardı
Yapay zeka donanımları ne kadar güçlü olursa ısı da o kadar artar; bu nedenle soğutma çözümleri artık sistemin en kritik parçalarından biridir. Daha önceki jenerasyon GB200 ve GB300 modellerinde hibrit (karışık) soğutma kullanılsa da, Vera Rubin tepsileri tamamen sıvı soğutma yöntemiyle çalışıyor. Bu süreç 'kuru soğutma' olarak adlandırılıyor.
Bu sistemlerde geleneksel fanlar bulunmadığından, teorik olarak veri merkezlerinin çok daha sessiz olması bekleniyor. Her ne kadar laboratuvar içinde ses seviyesi hala bir otomobilin AC ünitesinden biraz daha yüksek olsa da (tahmini 80-90 desibel aralığında), sıvı soğutma sistemi üst düzey verimlilik vaat ediyor.
NVL72 raflarına sıcaklığı belirli bir eşiğin altında kalan (45 derece veya altı) soğutucu akışkan ile gelen devasa borular, sistemdeki ısıyı doğrudan bir ısı değiştirici yardımıyla uzaklaştırıyor. Akışkanın girişinin üst kısımdan yapılıp çıkışının rafın alt kısmından sağlanması sayesinde tüm tepsiler otomatik olarak sisteme entegre edilebiliyor. Bu tamamen sıvı bazlı yaklaşım, veri merkezi operatörleri için soğutma maliyetlerinden enerji ve alan ihtiyacına kadar birçok alanda büyük bir optimizasyon anlamına geliyor.
Gelecekteki yapay zeka çözümleri yalnızca daha hızlı değil, aynı zamanda bu yeni mimari sayesinde çok daha verimli ve az kaynak tüketen donanımlar üzerine inşa edilecek.