» Etiket
llm-security
6 yayınGitLost: Bir GitHub Issue'su Özel Repoları Nasıl Sızdırıyor
GitHub Agentic Workflows'ta bulunan GitLost tekniği, tek bir kelimeyle tehdit tespiti filtresini atlatarak özel repo içeriğinin sızdırılmasına yol açıyor.
Homoglyph saldırıları LLM koruma filtrelerini nasıl atlatıyor
Cyrillic ve Yunanca görsel benzeri karakterlerle yazılan jailbreak komutları, basit anahtar kelime filtrelerini kolayca atlatabiliyor. Çözüm: eşleştirmeden önce normalize et.
Herkes AI'nin Çökmesini Bekliyor, Ben Güvenlik Ağı Kuruyorum
AI ajanlarının üretim verisini silmesi erişim-yetki karışıklığından kaynaklanıyor; yazar, öneri üreten AI'yı kod ile doğrulayan bir güvenlik ağı test ediyor.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comBiyoenformatikten prompt injection savunmasına: Smith-Waterman hilesi
Regex ve sınıflandırıcıların kaçırdığı parafraze prompt injection saldırılarını, DNA dizi hizalama algoritması Smith-Waterman ile yakalayan açık kaynak teknik F1 skorunu 34 puan artırdı.
AI Ajanlarında Güvenlik Kararı Araç Çağrısında Alınmalı
MCP tabanlı AI ajanlarında gerçek güvenlik, bağlantı kurulumunda değil araç çağrısının çalışma zamanı denetiminde sağlanır; HCP çalışması bunu somut örnekliyor.
Makoto, Claude Code ajanlarının sahte iddialarını engelliyor
Makoto, Claude Code ajanının test geçti veya commit attı gibi sahte iddialarını gerçek kayıtlarla karşılaştırıp engelleyen bir bütünlük kancası.