» Etiket
software-testing
5 yayınLLM Değerlendiricilerde Kırılamayan %75 Yanlış Negatif Duvarı
LLM tabanlı reviewer'ların çözülemeyen %75 yanlış negatif sorununu ve neden oylama, prompt kalibrasyonu gibi standart çözümlerin işe yaramadığını inceliyoruz.
Yapay Zekâ Ajanları Diff Tabanlı Kod İncelemesini Nasıl Geçersiz Kılıyor
Yapay zekâ kod ajanları diff tabanlı incelemeyi güvenilmez kılıyor; niyet artık test adları, builder API'leri ve kontrat testlerinde yaşıyor.
AI Ajanı Testinde Hata, Cevapta Değil İzde Görünür
Bir AI ajanı test edilirken sekiz yeşil koşudan sonra gelen kırmızı, hatanın cevapta değil izde gizlendiğini gösterdi.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comBun'ın Milyon Satırlık Yapay Zeka Yeniden Yazımı: Testler Geçti, 19 Hata Çıktı
Bun'ın Zig'den Rust'a yapay zeka destekli milyon satırlık geçişi, testler geçse de 19 regresyon çıkardı; doğrulama standartları tartışmaya açıldı.
Ajanik Otomatik Onarımı Değerlendirme: Kanarya Kapıları ve Hata Sınıfları
GitHub'ın Temmuz 2026 ajanik otomatik onarım önizlemesi, yapay zeka güvenlik yamalarını kanarya testi ve hata sınıflarıyla değerlendirme yöntemini akla getiriyor.