» Etiket
machine-learning
25 yayınHızlı, Etkileşimli Uzun-Kontekst Çıkarımı için AI Modeli Tasarımı
Uzun-kontekst AI modellerinin dikkat mekanizması ve çıkarım verimliliği üzerine pratik kılavuzlar.
AutoDesign: Uzun Vadeli Tasarım için Meta-Harness Optimizasyonu
AutoDesign, uzun vadeli tasarım için meta-harness optimizasyonu sunarak, insan tercihlerini en üst düzeye çıkarıyor.
Filtrelenmiş Vektör Arama: Acorn'un Çözdükleri ve Çözülmesi Gerekenler
Qdrant, filtrelenmiş vektör arama sorunlarını çözmek için yeni yaklaşımlar sunuyor. ACORN ve filtrelenebilir HNSW ile performansı artırıyor.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comBulut ve GPU olmadan güçlü AI: Liquid AI'nın yeni LFM2.5-2.6B modeli
Liquid AI, LFM2.5-2.6B modelini tanıttı; bu model, bulut ve GPU gerektirmeden yerel donanımda çalışabiliyor.
NVIDIA VoiceChat-11B: Gerçek Zamanlı Sesli İletişim İçin AI Modeli
NVIDIA VoiceChat-11B, 11 milyar parametre ile gerçek zamanlı sesli etkileşimler için geliştirilmiş bir AI modelidir.
MoE Yük Dengesizliğini Optimal Taşıma ile Çözme
MoE mimarisindeki yük dengesizliğini çözmek için TAOT yöntemi ile eğitim hızında %43 artış sağlandı.
1.5B Model Trained to Write Shell Commands on a Laptop CPU
Kullanıcı, 1.5B Qwen2.5-Coder modelini shell komutları yazmak için eğitti. Model, dizüstü bilgisayarda çalışıyor.
Hollow-LLM Saldırısı: Sıfır Bilgi LLM Doğrulamasını Aldatan Hayalet Ağırlıklar
Hollow-LLM saldırısı, sıfır bilgi doğrulama ile sahte ağırlıkların etkisini inceliyor.
Multi-Vektör (Geç Etkileşim) Gömme Modelleri ile Cümle Dönüştürücüler
Cümle Dönüştürücüler v6.0 ile MultiVectorEncoder modeli geldi. Geç etkileşimli alımda güçlü sonuçlar sunuyor.
Uygulama Ajan İzleri için Ucuz LLM'lerin Performans Testi
Uygulama ajan izleri için ucuz LLM'lerin performansını test ettik. Sonuçlar dikkat çekici.