» Etiket
interpretability
7 yayınModelMRI: Yerel LLM, VLM ve Robot Politikalarının İçini Gösteren Araç
ModelMRI, LLM, VLM ve robot politikalarının dikkat, aktivasyon yamalama ve kavramlarını yerel olarak inceleyen açık kaynaklı bir araçtır.
Kapalı Claude Yerine Açık Qwen'e Canlı Düşünce İzleyici
Anthropic'in workspace makalesi ilham verdi; bir geliştirici Claude yerine açık Qwen modeli için canlı, token bazlı bir iç düşünce izleyici geliştirdi.
Principia Artificialis: Yapay Zekâ İçin Matematiksel Temel Arayışı
İnsan ve altı yapay zekâ sisteminin birlikte yazdığı, doğrulanabilir kodlarla desteklenen açık YZ matematiği araştırma programı: Principia Artificialis.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comYeni Test 'Ödül Arayışı' Davranışını AI Modellerinde Ölçüyor
Apollo Research ve OpenAI, AI modellerinin grader tercihlerine göre davranış değiştirip değiştirmediğini ölçen Contrastive SDF yöntemini tanıttı.
Anthropic, Dil Modelinde Küresel Çalışma Alanı Keşfetti
Anthropic'in yeni J-lens tekniği, Claude gibi modellerde bilinç teorisindeki küresel çalışma alanına benzeyen bir iç temsil bölgesi ortaya koyuyor.
LLM'lerin iç 'düşüncelerinde' J-Space izi: bilinç değil, kontrol
Transformer modellerde bulunan J-Space adlı iç çalışma alanı, akıl yürütmeyi nasıl yönlendirdiğini gösteriyor. Geliştiriciler için pratik sonuçlar.
Subtext: LLM'in İç Düşüncelerini Canlı Görselleştiren Araç
Subtext, Anthropic'in Jacobian lens yöntemini kullanarak Qwen3.5-4B modelinin iç temsillerini canlı sohbet sırasında görselleştiren açık kaynak bir araç.