» Etiket
machinelearning
12 yayın24 GiB Dizüstü Bilgisayarda 200K-Token LLM Sunumu
JustFit, 24 GiB dizüstü bilgisayarda 200K-token LLM sunumunu mümkün kılıyor.
Mini-Jev: LLM Üzerinde Typesafe Jev Uygulaması
Mini-Jev, donmuş bir modelde JSON yerine çoktan seçmeli sorularla sınıflandırma yapıyor.
LLM Yargıçlarının Anlaşması: Güvenilirlik Sorusu
LLM yargıçlarının bağımsızlığı, çoğunluk oylamasından daha önemlidir. Yeni yöntem, yargıç ilişkilerini modelleyerek güvenilirliği artırmayı hedefliyor.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.com3.8B LLM'yi 0.384 CORE ile 998$'a Eğitmek – Hugo Vergnes
Hugo Vergnes, 3.8B parametreli bir LLM'yi 998$'a eğiterek 0.384 CORE puanı aldı. Proje, küçük LLM'ler için yapılandırma odaklı bir çerçeve ile gerçekleştirildi.
Yetenek Rehberli Madencilik ve LLM Ajan İzlerinin Derlenmesi
TraceCompiler, LLM ajan izlerini madencilik yaparak yürütülebilir iş akışlarına dönüştürüyor.
AMD-AGI/HyperLoom: LLM İş Yüklerini Otomatik Optimize Eden Sistem
ROCm Hyperloom, AMD GPU'larında LLM iş yüklerini otomatik optimize eden bir sistemdir.
LLM, NetHack'ı Geçti: İlk Başarı
GPT-6 Astra, NetHack 3.6.7'yi geçerek LLM'lerin oyun bilgisi ve uygulama yetenekleri arasındaki farkları gösterdi.
DeepSeek'in yeni modeli: Güçlü LLM'ler için yeni bir şablon
DeepSeek, yeni Flash 4.1 modelini tanıttı. Daha az kaynakla daha akıllı LLM'ler oluşturma potansiyeli taşıyor.
Veri İyileştirmeleri, AI Ön Eğitiminde İlerlemeyi Belirliyor
2019-2025 yılları arasında AI ön eğitiminde veri iyileştirmelerinin etkisi incelendi. Sonuçlar, model iyileştirmelerinden daha fazla verimlilik sağladığını gösteriyor.
Claude Kodunda Yılın Yönetimi: Demote Merdiveni
Claude Code ile yapılan deneyimler, kuralların yapılandırılması ve uygulanması konusunda önemli dersler sunuyor.