» Etiket
machine-learning
138 yayınllama.cpp'ye Kayıpsız F32 Sıkıştırma: QFX32/QFX16 ile 2.05x Küçülme
llama.cpp'ye eklenen QFX32/QFX16 GGUF tipleri, F32 modelleri doğruluk kaybı olmadan 2.05x sıkıştırıyor; teknik detaylar ve kullanım.
SDABench: LLM'leri Bilimsel Keşifte Test Eden Yeni Kıstas
SDABench, LLM'leri kod çalıştırma yerine altı bilimsel yetenek üzerinden test eden yeni bir kıstas; sonuçlar ciddi eksiklikleri ortaya koyuyor.
Harness Pretraining'den Önce mi Gelmeli? Veri Çarkı Perspektifi
AI ajanlarında harness ve pretraining ilişkisini, veri çarkı ve model önyargıları üzerinden inceleyen teknik bir analiz.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comAirbnb LLM Değerlendirmesini Haftalardan Bir Güne Nasıl İndirdi
Airbnb'nin dört katmanlı LLM değerlendirme altyapısı, deterministik önbellekleme ve micro LoRA adaptörleriyle iterasyon süresini haftalardan bir güne indiriyor.
FlowOptimizer: Akış Modelleriyle Öğrenen Optimizasyon
MIT ve Boston University'den araştırmacılar, popülasyon tabanlı akış modelleriyle optimizasyon adımlarını öğrenen ve klasik yöntemleri kat kat geride bırakan FlowOptimizer'ı tanıttı.
SensorFM: Giyilebilir Cihaz Verileriyle Genel Sağlık Zekası
SensorFM, 5 milyon kişiden toplanan 1 trilyon dakikalık sensör verisiyle eğitilen ve kalp, uyku, metabolizma, ruh sağlığını tahmin eden büyük ölçekli bir yapay zeka modeli.
Yapay Zeka Neden İngilizce Dışında Daha Kötü Çalışıyor?
Büyük dil modellerinin İngilizce dışında neden daha kötü çalıştığını; eğitim verisi, tokenizer verimliliği ve maliyet açısından inceliyoruz.
AVTensor: Eğitim Verisi İçin Rust Tabanlı Medya Kod Çözücü
Runway'in açtığı Rust kütüphanesi AVTensor, ses ve görüntüyü tek geçişte eş zamanlı çözerek gizli senkronizasyon hatalarını ortadan kaldırıyor ve eğitim MFU'sunu artırıyor.
LLM Quantization Rehberi: GPTQ, AWQ ve GGUF Karşılaştırması
Büyük dil modellerini 4-bit'e sıkıştırarak VRAM ihtiyacını düşüren quantization tekniklerini; GPTQ, AWQ, GGUF ve bitsandbytes yöntemlerini karşılaştırmalı olarak inceliyoruz.
Ölçekleme Yasaları: Kaplan'dan Chinchilla'ya, Aşırı Eğitime
LLM ölçekleme yasalarının Kaplan'dan Chinchilla'ya evrimi ve mühendislerin neden modelleri kasıtlı olarak aşırı eğittiği açıklanıyor.