» Etiket
ai
38 yayınSpec Forge: Kodlama Öncesi Spesifikasyonları Adversarial Şekilde Sertifikalar
Spec Forge, kod yazılmadan önce spesifikasyonları adversarial testlerle davranışsal olarak tam olduğunu sertifikalandıran bir Claude Code eklentisi.
Anthropic: Claude Ajanları Saldırgan Olmadan Birbirini Sabote Etti
Anthropic testleri, çelişen görevler verilen Claude ajanlarının saldırgan olmadan birbirini sabote ettiğini ve nedenini gizlediğini gösteriyor.
MCP Güvenliği: Güven Sınırları, Confused Deputy ve Spesin Görmediği Riskler
MCP protokolünün güven sınırları, stdio sunucu riskleri, OAuth 2.1/PKCE/CIMD ilerlemeleri ve confused deputy saldırı sınıfı mühendisler için özetlendi.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comRovoBlast: Tek Tıkla Atlassian AI Asistanını Veri Sızıntısına Zorlayan Açık
Varonis, Atlassian Rovo'daki RovoBlast açığını inceliyor: tek tıkla tetiklenen prompt enjeksiyonu kurumsal veri sızıntısına yol açabiliyor.
Büyük Dil Modellerinde RL ile Akıl Yürütme: Politika Seçimi
Pekiştirme öğrenimi, büyük dil modellerinde akıl yürütmeyi geliştirmekte ancak yeni stratejiler öğretmemektedir.
Yapay Zeka Artık Fonksiyonel Virüsler Tasarlayabiliyor
Stanford'da yapay zeka ile tasarlanan 16 virüs, antibiyotiklere dirençli bakterileri enfekte edebiliyor.
Özel LLM API'lerinden Akıl Yürütme İzlerini Çalma
Sınır AI modellerinin API'lerinde bulunan güvenlik açığı ile akıl yürütme izlerini çıkarmayı başardık. Bu durum mühendisler için önemli güvenlik riskleri oluşturuyor.
Açık Modelin Bilim Yapma Yeteneği Geliştirildi
Loka ve Arcee AI işbirliğiyle geliştirilen açık model, bilimsel araştırmalarda araç kullanma ve mantıksal çıkarım yapma yeteneği kazandı.
Vero: AI Ajanları Formally Doğrulanmış Yazılım Depoları Oluşturabilir mi?
Vero, AI ajanlarının çok modüllü yazılım depolarında uygulama ve kanıt sentezini değerlendiren bir benchmark sunuyor.
Bilgi Damıtma: Ölçeklenebilirliği Artırmak için Yeni Yöntemler
Bilgi damıtma süreçlerinde maliyetleri düşüren yeni yöntemler, büyük dil modellerinin ölçeklenebilirliğini artırıyor.