» Etiket
llm
472 yayınYapay Zeka Güvenlik Testi: Modeller Arasında 100 Kat Fark
Yeni jailbreak testi, öncü AI modelleri arasında 100 kata varan güvenlik farkı olduğunu, bazılarında hiç açık bulunmadığını ortaya koyuyor.
Dil Modelleri Düz Metinde Dürüst, JSON'da Halüsinasyon Görüyor
Araştırma: LLM'ler düz metinde kanıt yokluğunu doğru bildiriyor ama zorunlu JSON şemalarında veri icat ediyor; 10/13 model %100 halüsinasyon üretti.
Güvenilmez AI Ajanlarıyla Sağlam Yazılım Geliştirme Rehberi
AI kodlama ajanlarıyla güvenilir yazılım üretmek için bağlam yönetimi, doğrulama katmanları ve CLAUDE.md kullanan pratik mühendislik rehberi.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comTurboFieldfare: Gemma 4 26B MoE modeli Mac'te 2 GB RAM'le çalışıyor
TurboFieldfare, Gemma 4 26B MoE modelini uzman akışı ile 8 GB RAM'li Apple Silicon Mac'lerde 2 GB bellekle çalıştıran açık kaynaklı Swift/Metal motoru.
ButterClaw: Bulutsuz AI Ajan Güvenliği, İhlalde SIGKILL
ButterClaw, regex imzaları, yerel LLM karar mekanizması ve SIGKILL/kimlik bilgisi imhasıyla AI ajan güvenliğini bulutsuz, telemetrisiz sağlıyor.
CodeCrucible: LLM Tabanlı SAST için Yeniden Kullanılabilir Şablon
Block'un CodeCrucible aracı, parça bazlı taramalar yerine tüm depoyu analiz eden LLM tabanlı SAST için yeniden kullanılabilir bir tasarım şablonu sunuyor.
2.8 Trilyon Parametreli Kimi K3, 64GB M1 Mac'te Çalıştırıldı
Deltafin, 2.8 trilyon parametreli Kimi K3 MoE modelini 64GB'lık M1 Mac'te, tam kurulum veya akış modu ile çalıştırıyor.
Ctxdiff: LLM Ajanları İçin Git Diff Tarzı Bağlam Hata Ayıklayıcı
Ctxdiff, LLM ajanlarının context window'unu git-diff mantığıyla tur tur inceleyen, yerel çalışan açık kaynaklı hata ayıklama aracı.
Statik Tarayıcı AI Ajan Framework'lerinde 30 Korumasız Yıkıcı Eylem Buldu
Açık kaynaklı bir tarayıcı, 25 AI ajan framework'ünde modellerin yetkilendirme kontrolü olmadan silme, deploy ve webhook çağırabildiği 30 gerçek bulgu tespit etti.
Toolgz: LLM araç tanımlarında token kullanımını %80 azaltıyor
Toolgz, LLM ajanlarında araç tanımı token kullanımını %80 azaltıp doğruluğu koruyor; 420 koşuluk çapraz sağlayıcı testiyle doğrulandı.