» Etiket
research
16 yayınPoPE: Küçük Kod LLM'lerinde Hata Koşullu Kendini Onarma Değerlendirmesi
PoPE, küçük kod LLM'lerinde hata koşullu kendini onarma için yeni bir değerlendirme standardı sunuyor.
Dört denetlenebilir iş akışı: bağlam, araştırma, orkestra
Project Telos'un dört aracı için denetlenebilir iş akışları oluşturuldu.
Dağıtık Sistemler için Senaryo Testleri
Dağıtık sistemler için senaryo testleri geliştirilmiştir; yapay zeka ile otomatik test yazımı sağlanmıştır.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comYapay Zeka Modellerinin İfade Özgürlüğünü Koruma Değerlendirmesi
Büyük dil modellerinin ifade özgürlüğü üzerindeki etkileri ve sonuçları. LLM'lerin siyasi eleştirileri nasıl ele aldığına dair önemli bulgular.
LLM'ler Bilgisayar Mimarisi Makalelerini Derinlemesine Anlayabilir mi?
Büyük dil modellerinin bilgisayar mimarisi makalelerini derinlemesine anlama yeteneği inceleniyor. Gauntlet pipeline'ı ile yapılan analizler önemli bulgular sunuyor.
Mako: Otonom Web Sömürüsü için Kendini Geliştiren Bir İşletim Sistemi
Mako, otonom web sömürüsü için kendini geliştiren bir işletim sistemi olarak tanıtıldı.