» Etiket
software-testing
2 yayınLLM Değerlendiricilerde Kırılamayan %75 Yanlış Negatif Duvarı
LLM tabanlı reviewer'ların çözülemeyen %75 yanlış negatif sorununu ve neden oylama, prompt kalibrasyonu gibi standart çözümlerin işe yaramadığını inceliyoruz.
Bun'ın Milyon Satırlık Yapay Zeka Yeniden Yazımı: Testler Geçti, 19 Hata Çıktı
Bun'ın Zig'den Rust'a yapay zeka destekli milyon satırlık geçişi, testler geçse de 19 regresyon çıkardı; doğrulama standartları tartışmaya açıldı.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.com