DLSS ekran kartında çalışan bir yerel yapay zeka modeli, nasıl ki llama.cpp veya benzer yöntemle yapay zeka modelleri kullanılabiliyor DLSS de kabaca aynı mantıkla çalışıyor. Tabii gecikme son derece önemli olduğu için bu modeller çok düşük boyutlarda, deterministik bir yapıda. Bu kadar hızlı çıkarım yapabilmesi için de işte tensor çekirdekleri gerekiyor, tensor çekirdekleri matris çarpım işlemlerini olağanüstü şekilde hızlandırıyor, CUDA çekirdekleri ile bu hızda bunları yapabilmek mümkün değil. Ayrıca Blackwell mimarisinde NVFP4(sıkıştırma) desteği var, önceki serilerde bu destek maalesef yok. NVFP4 desteği ciddi hızlanma sağlıyor. Yani Nvidia’nın eski kartlara bazı şeyleri açmamasının arkasında bu tip teknik konular da vardır.