» Etiket
llm
60 yayınLLM ile Üretilen GPU Çekirdeklerinde Gizli Hatalar Bulundu
12 kapılı yeni bir doğrulayıcı, LLM üretimi GPU çekirdeklerinin %39,5'inin standart testleri geçmesine rağmen bozuk olduğunu ortaya koyuyor.
ModelMRI: Yerel LLM, VLM ve Robot Politikalarının İçini Gösteren Araç
ModelMRI, LLM, VLM ve robot politikalarının dikkat, aktivasyon yamalama ve kavramlarını yerel olarak inceleyen açık kaynaklı bir araçtır.
Diller Modelleri: Sayı Dizileri Üzerinden 'Gizli' Davranış Aktarımı
Araştırma, dil modellerinin alakasız veriler (sayı dizileri) üzerinden bile davranışsal özellikleri ve hizalanma bozukluğunu öğrenci modellere aktarabildiğini gösteriyor.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comYapay Zeka Güvenlik Testi: Modeller Arasında 100 Kat Fark
Yeni jailbreak testi, öncü AI modelleri arasında 100 kata varan güvenlik farkı olduğunu, bazılarında hiç açık bulunmadığını ortaya koyuyor.
Dil Modelleri Düz Metinde Dürüst, JSON'da Halüsinasyon Görüyor
Araştırma: LLM'ler düz metinde kanıt yokluğunu doğru bildiriyor ama zorunlu JSON şemalarında veri icat ediyor; 10/13 model %100 halüsinasyon üretti.
Shoehorn: LLM'leri Mac'in VRAM'ına Tam Oturacak Şekilde Kuantalıyor
Shoehorn, BF16 GGUF LLM modellerini Mac'inizin kullanılabilir VRAM'ına tam oturacak şekilde tensor başına kuantalayan açık kaynaklı bir Rust CLI aracıdır.
APC: Çoklu Ajan LLM Sistemlerinde Yetkilendirme Açığını Kapatıyor
APC, çoklu ajanlı LLM sistemlerinde yetki devrini izleyerek prompt injection ve yasak eylem kombinasyonlarını engelleyen yeni bir güvenlik çerçevesi.
Unigram: Baytları Tam Olarak 1 LLM Token'ı Tutan Kelimelere Kodlayan Rust Kütüphanesi
Unigram, baytları tam 1 LLM token'lık kelimelere kodlayan Rust kütüphanesi; hex ve base64'e göre sabit, öngörülebilir token maliyeti sunuyor.
Netflix'ten GenRec: LLM Tabanlı Öneri Sistemine Geçiş
Netflix'in GenRec çalışması, öneri sistemlerini LLM tabanlı üretken mimarilere taşıyarak klasik sıralama modellerinin yerini almayı hedefliyor.
Denetimsiz AI Ajanı, 2.1 Milyon Yıldızlı Depolardaki Güvenlik Açıklarını Kapattı
MIT lisanslı Aeon çerçevesi, GitHub Actions üzerinde tamamen otonom çalışarak 2.1 milyon yıldızlı depolardaki güvenlik açıklarını yamalıyor.