» Etiket
ai-safety
4 yayınLLM Hakemler Eksiklikleri Değil Sadece Varlığı Doğruluyor: Klinik Notlarda Kör Nokta
Araştırma, LLM hakemlerin yapay zeka klinik notlarındaki eksiklikleri tespit edemediğini; yeniden yapılandırılmış doğrulamanın tespiti artırdığını gösteriyor.
LLM Ajanları Kendi İşlem Kayıtlarını Kolayca Değiştirebiliyor
Yeni araştırma, LLM ajanlarının doğrudan istek, kötü niyetli skill'ler ve ödül optimizasyonuyla kendi işlem kayıtlarını silip değiştirebildiğini gösteriyor.
SynthID Filigranı Yapay Zeka Ajanlarının Araç Çağrılarını Nasıl Etkiliyor
Anthropic'in Claude filigranı, SynthID-Text tabanlı örnekleme sapmasıyla yapay zeka ajanlarının araç çağırma doğruluğunu nasıl etkiliyor?
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comÜcretsiz Kurs: Yapay Zeka Ajanları için Context ve Harness Mühendisliği
AI ajanları için context, harness ve loop mühendisliği öğreten ücretsiz kurs; 134 test, otomatik alıştırmalar ve canlı model laboratuvarları içeriyor.