» Etiket
prompt-injection
35 yayınDocker Desktop Açığı: Codex, Cursor ve Gemini CLI Sandbox'ını Deliyor
Docker Desktop, Codex, Cursor ve Gemini CLI'daki sıkı sandbox profillerini ayrıcalıklı soket ve VirtioFS mount yoluyla aşmayı mümkün kılıyor.
MCP'de Confused Deputy Sorunu: Kaynak Doğrulama Boşluğu ve DNS Rebinding
MCP protokolündeki confused deputy açığı: kaynak doğrulama eksikliği, prompt injection ve DNS rebinding saldırıları ile tespit kuralları.
Kapanan Prompt Güvenlik Duvarı Girişimi, Modelini ve 13 Bin Saldırıyı Açtı
Kapanan bir AI prompt güvenlik duvarı girişimi, DeBERTa tabanlı dedektörünü ve 13 bin gerçek jailbreak denemesini açık kaynak olarak yayınladı.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comGhostCommit: AI kod inceleyicilerinin göremediği sızıntı
GhostCommit saldırısı, zararlı talimatları PNG görsellerine gizleyerek Cursor Bugbot ve CodeRabbit'i nasıl atlattığını gösteriyor.
APPA: LLM Ajanlarında Veri Sızıntısını Sıfıra Yaklaştıran Politika Cebiri
APPA çerçevesi, LLM ajanlarında prompt injection saldırılarını %0-7'ye düşürürken kullanışlılığı da büyük ölçüde koruyor.
AI Ajanı Testinde Hata, Cevapta Değil İzde Görünür
Bir AI ajanı test edilirken sekiz yeşil koşudan sonra gelen kırmızı, hatanın cevapta değil izde gizlendiğini gösterdi.
Kendi LLM Güvenlik Proxy'sini Dört Turda Red Team Testine Soktum
Bir mühendis kendi LLM güvenlik proxy'sini dört turda test etti: sızıntı, jailbreak ve exfiltration açıklarını buldu, düzeltti ve streaming boşluğunu itiraf etti.
Bağlam Bombaları: AI Saldırganlarını Güvenlik Filtreleriyle Durdurmak
Tracebit araştırması, AI saldırganlarını canary'lere gizlenmiş bağlam bombalarıyla durduran yeni bir güvenlik tekniğini test ediyor; başarı oranı %90 düştü.
APC: Çoklu Ajan LLM Sistemlerinde Yetkilendirme Açığını Kapatıyor
APC, çoklu ajanlı LLM sistemlerinde yetki devrini izleyerek prompt injection ve yasak eylem kombinasyonlarını engelleyen yeni bir güvenlik çerçevesi.
GitLost: Bir GitHub Issue'su Özel Repoları Nasıl Sızdırıyor
GitHub Agentic Workflows'ta bulunan GitLost tekniği, tek bir kelimeyle tehdit tespiti filtresini atlatarak özel repo içeriğinin sızdırılmasına yol açıyor.