» Etiket
llm-safety
2 yayınBağlam Bombaları: AI Saldırganlarını Güvenlik Filtreleriyle Durdurmak
Tracebit araştırması, AI saldırganlarını canary'lere gizlenmiş bağlam bombalarıyla durduran yeni bir güvenlik tekniğini test ediyor; başarı oranı %90 düştü.
Yapay zeka ajanlarının hatalı araç çağrılarını önceden yakalayan yöntem
Araştırmacılar, seyrek otokodlayıcılar ve doğrusal problarla ajan modellerinin iç durumunu okuyarak riskli araç çağrılarını eylemden önce tespit eden bir yöntem geliştirdi.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.com