» Etiket
ml
8 yayınEmbedcache: Gömme API Maliyetlerini Önbellekle Kesin
Embedcache, gömme API maliyetlerini azaltarak yinelenen istekleri önleyen bir proxy sunuyor.
Qwen 3.6 27B Modeli ile 16GB VRAM'de 20 t/s Hız
Qwen 3.6 27B modeli ile 16GB VRAM'de yapılan yapılandırma ve hız testleri hakkında bilgi.
DiffusionGemma: Metin Üretiminde 4 Kat Hız Artışı
DiffusionGemma, metin üretiminde 4 kat hız artışı sağlayan deneysel bir modeldir.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comÜretim için Sağlam Bir RAG Pipeline Mimarisi Oluşturma
RAG pipeline mimarisi, belgeleri işleyip dil modellerine besleyen hizmetler setidir. Modüler tasarım ve hızlı vektör deposu gereklidir.
GLM-4.7-Flash ve 2x RTX 3090: Deneyimim
GLM-4.7-Flash, 2x RTX 3090 ile test edildi. Kısa ve uzun bağlamlarda performans karşılaştırması yapıldı.
2026'da Azure AI Search ile RAG Pipeline Oluşturma
Azure AI Search, 2026'da RAG pipeline'ları için yeni yaklaşımlar sunuyor. Hibrid arama ve Semantic Ranker ile daha etkili sonuçlar elde edin.
Kendi ML opsiyon tahminlerimi değerlendirdim: Brier skoru
Kendi ML opsiyon tahminlerimi değerlendirdim. Brier skoru, 0.3846 ile madeni paradan daha kötü bir sonuç verdi.
llama.cpp CPU Yükleme Optimizasyonları
llama.cpp için CPU yükleme optimizasyonları: CUDA grafiklerini devre dışı bırakın ve FFN alt katmanlarını CPU'ya yönlendirin.