» Etiket
llm
14 yayınLLM ile Üretilen GPU Çekirdeklerinde Gizli Hatalar Bulundu
12 kapılı yeni bir doğrulayıcı, LLM üretimi GPU çekirdeklerinin %39,5'inin standart testleri geçmesine rağmen bozuk olduğunu ortaya koyuyor.
Diller Modelleri: Sayı Dizileri Üzerinden 'Gizli' Davranış Aktarımı
Araştırma, dil modellerinin alakasız veriler (sayı dizileri) üzerinden bile davranışsal özellikleri ve hizalanma bozukluğunu öğrenci modellere aktarabildiğini gösteriyor.
Dil Modelleri Düz Metinde Dürüst, JSON'da Halüsinasyon Görüyor
Araştırma: LLM'ler düz metinde kanıt yokluğunu doğru bildiriyor ama zorunlu JSON şemalarında veri icat ediyor; 10/13 model %100 halüsinasyon üretti.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comShoehorn: LLM'leri Mac'in VRAM'ına Tam Oturacak Şekilde Kuantalıyor
Shoehorn, BF16 GGUF LLM modellerini Mac'inizin kullanılabilir VRAM'ına tam oturacak şekilde tensor başına kuantalayan açık kaynaklı bir Rust CLI aracıdır.
Netflix'ten GenRec: LLM Tabanlı Öneri Sistemine Geçiş
Netflix'in GenRec çalışması, öneri sistemlerini LLM tabanlı üretken mimarilere taşıyarak klasik sıralama modellerinin yerini almayı hedefliyor.
CAKE: Yapay Zeka Ajanlarına Özel Derleyici Tasarımıyla Hızlı GPU Çekirdekleri
CAKE, yapay zeka ajanlarını donanıma özgü derleyici IR'ı ile birleştirerek B200'de ayarlanmış GPU çekirdek performansını geçiyor.
MCP Güvenliği: Güven Sınırları, Confused Deputy ve Spesin Görmediği Riskler
MCP protokolünün güven sınırları, stdio sunucu riskleri, OAuth 2.1/PKCE/CIMD ilerlemeleri ve confused deputy saldırı sınıfı mühendisler için özetlendi.
Özel LLM API'lerinden Akıl Yürütme İzlerini Çalma
Sınır AI modellerinin API'lerinde bulunan güvenlik açığı ile akıl yürütme izlerini çıkarmayı başardık. Bu durum mühendisler için önemli güvenlik riskleri oluşturuyor.
Commons: LLM Ajanları Arasında Bilgi Miras Deneyleri
Commons, LLM ajanları arasında bilgi mirası ve hatalarını araştıran deneysel bir çerçevedir.
LLM çağrıları için kayıt standartları yok, ben de bir kayıt oluşturdum
Johannes, LLM çağrıları için bir kayıt sistemi geliştirerek AI kullanımının izlenebilirliğini sağladı.