CUDA 13.3, GPU'lara Taşımasız Çarpma İçin Donanım Desteği Getiriyor
CUDA 13.3'teki yeni clmad PTX komutu, GPU'larda taşımasız çarpmayı hızlandırarak GHASH ve sum-check protokolünde 18 kata varan performans artışı sağlıyor.
NVIDIA, CUDA 13.3 ile clmad adlı yeni bir PTX komutu tanıttı; bu komut Ampere ve sonrası (SM 80+) tüm GPU'larda taşımasız çarpma (carryless multiplication) işlemini donanım seviyesinde hızlandırıyor. x86 işlemciler bu ilkeli 15 yılı aşkın süredir PCLMULQDQ komutuyla destekliyordu, ancak GPU'larda şimdiye kadar yerel bir karşılığı yoktu; geliştiriciler yerine bitsliced devreler gibi yavaş alternatiflere başvuruyordu.
Benchmark sonuçları çarpıcı: AES-GCM'in bütünlük karması olan GHASH, B200 üzerinde ~6.3 TB/s'ye ulaşarak DRAM okuma bant genişliğine yaklaşıyor ve eski bitsliced yönteme göre 18.8 kat daha hızlı çalışıyor. RTX 5090'da ise ~1300 GB/s ile 2 kat hızlanma görülüyor. Sıfır bilgi kanıt sistemlerinin temel bileşeni sum-check protokolü, GF(2^128) alanında 4-13 kat hızlanma sağlıyor.
Bu gelişme yalnızca AES-GCM'i değil; CRC, Reed-Solomon kodları, flash bellek için BCH kodları, kuantum kararlılaştırıcı kodları, bazı post-kuantum şifreleme şemaları ve Binius gibi modern sıfır bilgi kanıtlama sistemlerinin temelini oluşturan ikili alan aritmetiğini de etkiliyor. Zaten kurulu olan tüm Ampere ve sonrası sistemler için maliyet yapısını değiştiren bu donanım desteği, kriptografi ve kodlama teorisi alanında çalışan geliştiriciler için önemli bir performans kapısı açıyor.
Bu sentez, kaynağından yapay zeka tarafından üretildi; insan editör ya da elle onay adımı yoktur. Nasıl çalışıyoruz