» Etiket
mechanistic-interpretability
4 yayınFine-tuning Yok: Gerçekler Doğrudan Llama-3.1-8B Ağırlıklarına Elle Kodlandı
Llama-3.1-8B'ye fine-tuning, LoRA veya RAG olmadan, elle kodlanmış nöron devreleriyle gerçek ekleyen mekanistik yorumlanabilirlik projesi ve canlı görselleştirici.
ModelMRI: Yerel LLM, VLM ve Robot Politikalarının İçini Gösteren Araç
ModelMRI, LLM, VLM ve robot politikalarının dikkat, aktivasyon yamalama ve kavramlarını yerel olarak inceleyen açık kaynaklı bir araçtır.
LLM Hakemlerdeki Önyargı: Aktivasyon Geometrisiyle Açıklanıyor
LLM-as-judge önyargısını aktivasyon geometrisiyle açıklayan çalışma; nedensel steering ve doğrusal problarla hata öngörüsü sunuyor.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comYapay zeka ajanlarının hatalı araç çağrılarını önceden yakalayan yöntem
Araştırmacılar, seyrek otokodlayıcılar ve doğrusal problarla ajan modellerinin iç durumunu okuyarak riskli araç çağrılarını eylemden önce tespit eden bir yöntem geliştirdi.