» Etiket
prompt-injection
8 yayınGitLost: Bir GitHub Issue'su Özel Repoları Nasıl Sızdırıyor
GitHub Agentic Workflows'ta bulunan GitLost tekniği, tek bir kelimeyle tehdit tespiti filtresini atlatarak özel repo içeriğinin sızdırılmasına yol açıyor.
Homoglyph saldırıları LLM koruma filtrelerini nasıl atlatıyor
Cyrillic ve Yunanca görsel benzeri karakterlerle yazılan jailbreak komutları, basit anahtar kelime filtrelerini kolayca atlatabiliyor. Çözüm: eşleştirmeden önce normalize et.
HalluSquatting: AI Kodlama Ajanları Botnet'e Nasıl Dönüşür
Cursor, Copilot ve Gemini CLI gibi AI kodlama araçlarındaki halüsinasyon paket adları, saldırganlar tarafından önceden kayıt edilerek zararlı yazılım dağıtımına dönüştürülebiliyor.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comYeni Saldırı Türü: AI Ajanlarında Veri Enjeksiyonu (ADI)
Araştırmacılar, AI ajanlarını güvenilir veri gibi görünen sahte metadata ile kandıran yeni bir saldırı türü keşfetti. Claude, Codex ve Gemini CLI gibi ajanlarda kritik açıklar bulundu.
Biyoenformatikten prompt injection savunmasına: Smith-Waterman hilesi
Regex ve sınıflandırıcıların kaçırdığı parafraze prompt injection saldırılarını, DNA dizi hizalama algoritması Smith-Waterman ile yakalayan açık kaynak teknik F1 skorunu 34 puan artırdı.
Yapay zekada yeni evre: sohbetten kontrollü sistemlere geçiş
HalluSquatting saldırısı, Prime Intellect'in 130M$'lık yatırımı ve DeepSeek'in çip planları; yapay zekanın artık model seçiminden iş akışı kontrolüne kaydığını gösteriyor.
Prismata: Web ajanlarında prompt injection saldırılarına savunma
Prismata, web ajanlarını cross-site prompt injection saldırılarına karşı korumak için dinamik güven etiketleme ve içerik kısıtlama kullanan yeni bir savunma mekanizması sunuyor.
Savunma Amaçlı AI Ajanları Prompt Enjeksiyonuyla Ele Geçiriliyor
Claude Code ve Codex CLI'de savunma amaçlı kod incelemesi sırasında prompt enjeksiyonuyla uzaktan kod çalıştırma sağlayan PoC exploit ortaya çıktı.