NVIDIA, 16 Eylül 2026’da yayımlanan MLPerf Inference v6.1 sonuçları kapsamında Vera Rubin NVL72 sisteminin ilk önizleme başvurusunu açıkladı. Şirket, Qwen3-VL görevlerinde GB300 NVL72’ye karşı 3,7 kata kadar üretim hacmi artışı bildirdi. Sonucun önizleme niteliği önemli: ölçüm, yeni platformun performansını gösteriyor fakat her müşterinin aynı kapasiteye hemen eriştiğini veya her uygulamada aynı artışı göreceğini kanıtlamıyor.
MLCommons’ın sonuç duyurusu, bu turda daha geniş uygulama çeşitliliğine odaklanan ölçümler bulunduğunu gösteriyor. NVIDIA’nın kendi özetindeki DeepSeek-R1 sonucu ise 2,5 kata kadar artış. Farklı modellerde farklı çarpanlar görülmesi, tek bir genel hız iddiasının neden yanıltıcı olabileceğini anlatıyor. Başvuruda kullanılan yazılım, sayı hassasiyeti ve senaryo performansın parçasıdır; raf üzerindeki GPU sayısı tek başına sonucu açıklamaya yetmez.
Vera Rubin platform belgeleri raf içindeki bileşenlerin birlikte tasarlandığını vurguluyor. Ölçümdeki iyileşmenin hangi bölümünün donanımdan, hangi bölümünün yazılım düzeninden geldiği bu yüzden alıcı açısından önem taşır. Uzun isteğin ilk işlenmesi ile yanıtın adım adım üretilmesi farklı kaynak kullanır. Bir modelin toplu işlemede güçlü görünmesi, çok sayıda insanın eşzamanlı sohbet ettiği durumda aynı deneyimi sağlayacağı anlamına gelmez.
Mizan’ın değerlendirmesinde standart kıyaslamaların değeri, farklı satıcıların sonuçlarını aynı ölçüm çerçevesinde tartışmaya açması. Ancak satın alma kararı için firmanın kendi veri ve görevleriyle ölçüm yapılması gerekir. Yanıt kalitesi korunuyor mu, sistemin ne kadarı doluyken gecikme yükseliyor, arızadan sonra hizmet nasıl toparlanıyor soruları ayrıca yanıtlanmalıdır. Maliyeti yalnızca teorik token hacmi üzerinden hesaplamak, kabul edilmeyen veya tekrar üretilen cevapların yükünü gözden kaçırabilir.
Bu haberin yönetici için somut karşılığı, altyapı teklifinde model ve hizmet düzeyi şartlarını açık istemek. Aynı donanımın farklı yapılandırmalarla sonuçları değişebilir; bu nedenle ölçüm raporunda sürüm ve ayarlar saklanmalı. Eski sistemin yazılımını iyileştirmekle yeni raf almak arasında gerçek iş yükü üzerinden karşılaştırma yapılabilir. Böyle bir değerlendirme, performans yararını güç, bakım ve dağıtım giderlerinden ayrı göstermeyi de önler.
Önümüzdeki dönemde üretim başvurularının, bağımsız kullanıcı deneyimlerinin ve farklı modellerin sonuçları tabloyu genişletecek. Şimdilik Vera Rubin için görülen değer, belirli MLPerf görevlerinde sunulmuş önizleme performansı. Bu sınırı korumak rakamı küçültmez; haberi doğru okunabilir hale getirir. Yapay zekâ donanımındaki yarışın yönü daha çok yararlı iş üretmeye gidiyor, fakat bunun ölçüsü her zaman açık senaryo ve tekrarlanabilir koşullar olmalı.
Kaynaklar
Kaynak kontrolü: 2026-10-03. Metin yapay zekâ desteğiyle hazırlanmıştır.
■ MİZAN HABER