» Etiket
evaluation
4 yayınNicheIQ mühendisliği: Yapay zekaya gerçeği söyletmek
NicheIQ'nun kendi kendini değerlendiren yapay zekayı dürüstleştirme sürecine dair mühendislik notları: yanlılık, başarısız döngüler ve bir 'Yapma' kararı.
Few-shot örnekleri eval setinden geldi: 0.94 skoru bir kurguydu
Few-shot seçici ve eval seti aynı JSONL dosyasını paylaşınca 0.94 skoru sahteydi. Prompt-zamanı veri kirlenmesi ve kontrol yöntemi.
Yeni Bir Tahta Oyunu İçin MLP Değerlendirici Nasıl Oluşturdum
Larss oyunu için geliştirilen MLP değerlendirme motoru ve sonuçları hakkında bilgi edinin.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comSELECT first_name, last_name ve SELECT first_name || ' ' || last_name arasındaki fark
SQL sorgu değerlendirmelerinde, sütun birleştirmenin sonuç seti üzerindeki etkisi ve çözüm önerisi.