« Tüm yayınlar

Hollow-LLM Saldırısı: Sıfır Bilgi LLM Doğrulamasını Aldatan Hayalet Ağırlıklar

Hollow-LLM saldırısı, sıfır bilgi doğrulama ile sahte ağırlıkların etkisini inceliyor.

Büyük dil modellerinin (LLM) ölçeği arttıkça, güvenilir çıkarım doğrulaması kritik hale geliyor. Sıfır bilgi (ZK) LLM çıkarımı, kamuya açık doğrulama sunarak, özel ağırlıklar altında kamuya açık bir mimarinin çalıştırılmasının tutarlılığını kanıtlıyor. Ancak, bu çalışmada, sahte ağırlıklar kullanarak, doğrulama döngüsünü geçebilen ve daha küçük bir modelle hesaplama yapan sahte sağlayıcıların Hollow-LLM Saldırısı tanıtılmaktadır. Bu durum, sağlayıcıların daha küçük maliyetle doğru çıktılar sunmalarına olanak tanırken, model boyutunu aşırı beyan etmelerine yol açıyor. Bu bulgular, doğru çıkarım kanıtının büyük model yürütmesini kanıtlamadığını ve doğrulanabilir hesaplamalara ek korumaların gerektiğini vurguluyor.