» Etiket
interpretability
6 yayınKapalı Claude Yerine Açık Qwen'e Canlı Düşünce İzleyici
Anthropic'in workspace makalesi ilham verdi; bir geliştirici Claude yerine açık Qwen modeli için canlı, token bazlı bir iç düşünce izleyici geliştirdi.
Principia Artificialis: Yapay Zekâ İçin Matematiksel Temel Arayışı
İnsan ve altı yapay zekâ sisteminin birlikte yazdığı, doğrulanabilir kodlarla desteklenen açık YZ matematiği araştırma programı: Principia Artificialis.
Yeni Test 'Ödül Arayışı' Davranışını AI Modellerinde Ölçüyor
Apollo Research ve OpenAI, AI modellerinin grader tercihlerine göre davranış değiştirip değiştirmediğini ölçen Contrastive SDF yöntemini tanıttı.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comAnthropic, Dil Modelinde Küresel Çalışma Alanı Keşfetti
Anthropic'in yeni J-lens tekniği, Claude gibi modellerde bilinç teorisindeki küresel çalışma alanına benzeyen bir iç temsil bölgesi ortaya koyuyor.
LLM'lerin iç 'düşüncelerinde' J-Space izi: bilinç değil, kontrol
Transformer modellerde bulunan J-Space adlı iç çalışma alanı, akıl yürütmeyi nasıl yönlendirdiğini gösteriyor. Geliştiriciler için pratik sonuçlar.
Subtext: LLM'in İç Düşüncelerini Canlı Görselleştiren Araç
Subtext, Anthropic'in Jacobian lens yöntemini kullanarak Qwen3.5-4B modelinin iç temsillerini canlı sohbet sırasında görselleştiren açık kaynak bir araç.