» Etiket
llm-security
14 yayınLeakyLMs: Zamanlama Analiziyle LLM Mimarisi ve Optimizasyonları Sızdırılıyor
LeakyLMs araştırması, token zamanlama analiziyle LLM API'lerinden mimari ve speculative decoding bilgilerinin nasıl sızdırılabileceğini ortaya koyuyor.
MCP'de Confused Deputy Sorunu: Kaynak Doğrulama Boşluğu ve DNS Rebinding
MCP protokolündeki confused deputy açığı: kaynak doğrulama eksikliği, prompt injection ve DNS rebinding saldırıları ile tespit kuralları.
Kapanan Prompt Güvenlik Duvarı Girişimi, Modelini ve 13 Bin Saldırıyı Açtı
Kapanan bir AI prompt güvenlik duvarı girişimi, DeBERTa tabanlı dedektörünü ve 13 bin gerçek jailbreak denemesini açık kaynak olarak yayınladı.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comMCP Güvenliğinde Ölçme Devrimi: %9'dan %63'e Çıkan Proxy
Açık kaynak mcp-defense-bench kıyaslaması, MCP güvenlik proxy'si mcp-bastion'ın kapsamını %9'dan %63'e nasıl çıkardığını gösteriyor.
Kendi LLM Güvenlik Proxy'sini Dört Turda Red Team Testine Soktum
Bir mühendis kendi LLM güvenlik proxy'sini dört turda test etti: sızıntı, jailbreak ve exfiltration açıklarını buldu, düzeltti ve streaming boşluğunu itiraf etti.
GitLost: Bir GitHub Issue'su Özel Repoları Nasıl Sızdırıyor
GitHub Agentic Workflows'ta bulunan GitLost tekniği, tek bir kelimeyle tehdit tespiti filtresini atlatarak özel repo içeriğinin sızdırılmasına yol açıyor.
OpenClaw WhatsApp Açığı: 3 GHSA Zafiyeti Mesajı Sunucu Ele Geçirmeye Çeviriyor
OpenClaw'da WhatsApp meta verisi ve sandbox kontrol açığı birleşince tek mesaj tam host ele geçirmesine yol açtı; 3 GHSA zafiyeti 2026.6.6'da düzeltildi.
Homoglyph saldırıları LLM koruma filtrelerini nasıl atlatıyor
Cyrillic ve Yunanca görsel benzeri karakterlerle yazılan jailbreak komutları, basit anahtar kelime filtrelerini kolayca atlatabiliyor. Çözüm: eşleştirmeden önce normalize et.
Araştırma: LLM'lerin rol tanıma açığı saldırılara karşı temelden kırılgan
ICML araştırması, LLM'lerin rolleri etiket değil metin üslubuyla tanıdığını, bunun da temelden çözülemez bir güvenlik açığı yarattığını gösteriyor.
Ölümcül Üçleme: MCP Sunucularınızda Sessizce Bekleyen Veri Sızıntısı Riski
MCP sunucularında sıfır günlük açık gerektirmeyen 'ölümcül üçleme' saldırısı ve mimari savunma yöntemi mühendisler için açıklandı.