» Etiket
benchmarking
63 yayınQwen3.6-27B'de KV Önbellek Kuantizasyonunun KLD Etkisi
Bartowski'nin Qwen3.6-27B GGUF modelinde Q8, Q6 ve Q5 seviyelerinde KV önbellek kuantizasyonunun KL diverjansına etkisi ölçüldü; (q8_0,q8_0) neredeyse bedava kalite koruyor.
Postgres Rust ile Yeniden Yazıldı: v0.2 Daha Hızlı
pgrust v0.2, Postgres'in Rust ile yeniden yazılmış versiyonu, hızda çığır açıyor.
DeepSWE: AI Kodlama Ajanlarını Değerlendirmek İçin En İyi Ölçüt mü?
DeepSWE, AI kodlama ajanlarının performansını değerlendirmek için yenilikçi bir ölçüm platformudur.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comMoonshot AI'nin Kimi K3 Modeli, Claude Fable 5'i Geride Bıraktı
Moonshot AI, Kimi K3 modelini tanıttı. K3, 2.8 trilyon parametre ile kodlama testlerinde öne çıktı.
Ajanlar Kütüphane Tasarlayabilir mi?
LibraryDesignBench, ajanların yazdığı kütüphaneleri değerlendiren yeni bir benchmark sunuyor.
GEMM Performans Ölçüm Yöntemleri Rehberi
GEMM performansını ölçmek için güvenilir ve tekrarlanabilir yöntemler geliştirin.
Node-semver'in Rust ile Yeniden Yazımı ve Performans Testleri
Rust ile yeniden yazılan rs-semver, Node.js projeleri için performans artışı sunuyor.
Muse Spark 1.1 ve GPT-5.6 Tanıtıldı; Rust 1.97 Yayınlandı
AI Gateway'de Muse Spark 1.1 ve GPT-5.6 tanıtıldı; Rust 1.97, sembol karıştırma sistemini güncelledi.
Yapay Zeka Devre Kartı Tasarlayabilir mi?
OpenAI'nin GPT-6 Astra'sı ile devre kartı tasarımı üzerine yapılan çalışmalar mühendislikte yeni bir dönem başlatıyor.
Faiss, Turbovec ve Infino: 4-bit vektör kuantizasyonunu karşılaştırma
FAISS, turbovec ve Infino'nun 4-bit vektör kuantizasyonu yöntemlerini karşılaştırıyoruz.