» Etiket
ml
19 yayın24 GiB Dizüstü Bilgisayarda 200K-Token LLM Sunumu
JustFit, 24 GiB dizüstü bilgisayarda 200K-token LLM sunumunu mümkün kılıyor.
Embedcache: Gömme API Maliyetlerini Önbellekle Kesin
Embedcache, gömme API maliyetlerini azaltarak yinelenen istekleri önleyen bir proxy sunuyor.
Qwen 3.6 27B Modeli ile 16GB VRAM'de 20 t/s Hız
Qwen 3.6 27B modeli ile 16GB VRAM'de yapılan yapılandırma ve hız testleri hakkında bilgi.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comDiffusionGemma: Metin Üretiminde 4 Kat Hız Artışı
DiffusionGemma, metin üretiminde 4 kat hız artışı sağlayan deneysel bir modeldir.
Üretim için Sağlam Bir RAG Pipeline Mimarisi Oluşturma
RAG pipeline mimarisi, belgeleri işleyip dil modellerine besleyen hizmetler setidir. Modüler tasarım ve hızlı vektör deposu gereklidir.
Hızlı ve Enerji Verimli LLM için Analog Bellek İçi Hesaplama Mekanizması
Analog bellek içi hesaplama ile dikkat mekanizmasında enerji verimliliği artırılıyor.
Rust ile Uçtan Uca Dil Modeli Eğitimi: Bir Deneyim Raporu
Rust ile uçtan uca dil modeli eğitimi deneyimim ve Rust ML çerçevelerindeki hatalar.
MiniMax-Music3 ile Uzun Süreli AI Müzik Üretimi Değerlendirmesi
MiniMax-Music3, beş dakikaya kadar şarkılar üreten bir AI müzik modeli. Uzun süreli müzik yapısı ve detaylı düzenleme sunuyor.
GLM-4.7-Flash ve 2x RTX 3090: Deneyimim
GLM-4.7-Flash, 2x RTX 3090 ile test edildi. Kısa ve uzun bağlamlarda performans karşılaştırması yapıldı.
2026'da Azure AI Search ile RAG Pipeline Oluşturma
Azure AI Search, 2026'da RAG pipeline'ları için yeni yaklaşımlar sunuyor. Hibrid arama ve Semantic Ranker ile daha etkili sonuçlar elde edin.