» Etiket
benchmarks
2 yayınScarfBench: Java Framework Göçünde AI Ajanlarını Test Eden Benchmark
ScarfBench, AI ajanlarının Spring/Jakarta EE/Quarkus arası Java göçlerinde derleme, dağıtım ve davranış başarısını ölçen açık benchmark.
Yerel LLM Modelim 6/6 Skor Aldı, Her Seferinde Yanlış Cevap Verdi
Yerel LLM modelinin yanıt biçimi ile değeri arasındaki farkı keşfedin.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.com