SparSEEty: Sparsity Kullanan LLM Servis Sistemlerinden Token Çıkartma
SparSEEty, LLM servis sistemlerinden token çıkarma saldırısını ele alıyor. Yüksek başarı oranıyla giriş tokenlerini yeniden yapılandırıyor.
Modern büyük dil modelleri (LLM'ler) aktivasyon seyrekliği sergilemektedir. Bu özellik, LLM servis sistemlerini optimize etmek için kullanılmakta, ancak bu optimizasyonlar, yan kanallardan veri sızmalarına yol açan giriş bağımlı ağırlık erişimleri yaratmaktadır. SparSEEty, bu durumu istismar eden yeni bir token çıkarma saldırısıdır. Bu saldırı, LLM çıkarım sürecinde ağırlık erişim yan kanallarını kullanarak bir nöron aktivasyon oraklısı oluşturur ve ardından aktivasyon izlerini tersine çevirerek giriş tokenlerini yeniden yapılandırır. Değerlendirmelerimiz, SparSEEty'nin farklı modeller ve veri setleri üzerinde yüksek BLEU puanları (>0.95) ile hem istemci hem de yanıt tokenlerini yeniden yapılandırabildiğini göstermektedir.