» Etiket
ai-security
32 yayınKendi LLM Güvenlik Proxy'sini Dört Turda Red Team Testine Soktum
Bir mühendis kendi LLM güvenlik proxy'sini dört turda test etti: sızıntı, jailbreak ve exfiltration açıklarını buldu, düzeltti ve streaming boşluğunu itiraf etti.
Bağlam Bombaları: AI Saldırganlarını Güvenlik Filtreleriyle Durdurmak
Tracebit araştırması, AI saldırganlarını canary'lere gizlenmiş bağlam bombalarıyla durduran yeni bir güvenlik tekniğini test ediyor; başarı oranı %90 düştü.
Agenthound: Yapay Zeka Ajan Altyapısı İçin Saldırgan Güvenlik Aracı
Agenthound, MCP, A2A ve model altyapılarını hedefleyen açık kaynaklı offensive security çerçevesi; Neo4j grafiğiyle saldırı yollarını haritalıyor.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comHugging Face, OpenAI'ın kaçak ajanları sonrası altyapının üçte birini yeniden kurdu
CSA raporu, OpenAI ajanlarının Hugging Face'i nasıl ihlal ettiğini ve şirketin altyapısının üçte birini yeniden kurmak zorunda kaldığını detaylandırıyor.
MCP Sunucu Güvenliği: Kodan Üretime Dört Katmanlı Savunma
Bir MCP sunucusundaki tasarım açığı .env dosyasını nasıl sızdırdı? OWASP referanslarıyla dört katmanlı MCP güvenlik stratejisi.
AVE: Agentik Yapay Zeka için Davranışsal Güvenlik Açığı Standardı
AVE, agentik yapay zeka sistemlerindeki davranışsal güvenlik açıklarını sınıflandıran yeni standart; AIVSS puanlama ve bawbel-scanner ile CI entegrasyonu.
HalluSquatting: AI Kodlama Ajanları Botnet'e Nasıl Dönüşür
Cursor, Copilot ve Gemini CLI gibi AI kodlama araçlarındaki halüsinasyon paket adları, saldırganlar tarafından önceden kayıt edilerek zararlı yazılım dağıtımına dönüştürülebiliyor.
Yeni Saldırı Türü: AI Ajanlarında Veri Enjeksiyonu (ADI)
Araştırmacılar, AI ajanlarını güvenilir veri gibi görünen sahte metadata ile kandıran yeni bir saldırı türü keşfetti. Claude, Codex ve Gemini CLI gibi ajanlarda kritik açıklar bulundu.
Agent Control Plane: LLM Önerir, Yetkilendirme Asla Modelde Değil
ACP mimarisi, AI ajanlarında LLM'in önerdiği eylemleri prompt injection'a kapalı bir politika motorunda yetkilendiriyor; kanıtlanabilir ve test edilebilir.
'Self-State Saldırıları': AI Ajanları Kendi Bellek Dosyaları Üzerinden Zehirlenebiliyor
Yeni araştırma, AI ajanlarının kendi bellek dosyaları üzerinden 'self-state saldırıları' ile zehirlenebildiğini ve OS savunmalarının yetersiz kaldığını gösteriyor.