» Etiket
inference
4 yayınNVIDIA Dynamo ile LLM Çıktı Kapasitesini Hızla Yenileyin
NVIDIA Dynamo'daki gölge motoru kurtarma, LLM süreçlerinin hızlı bir şekilde yeniden başlatılmasını sağlıyor.
AMD MI300X ve Nvidia H100 ile 72B LLM için byte-aynı çıkarım
Yeni bir protokol, AMD MI300X ve Nvidia H100 ile 72B LLM için byte-aynı çıkarımlar üretiyor.
Darkbloom: Mac'lerde AI Çıkarım ve Güvenlik Denetimi
Darkbloom, Mac'lerde AI çıkarımını sağlayan bir ağdır. Güvenlik denetimi sonuçları ve bulgular burada.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comNvidia ve Cerebras: Müşterilerin Asla Göremeyeceği Performans Satışı
Nvidia ve Cerebras, Hot Chips konferansında performanslarını duyurdu. Ancak bu rakamlar, gerçek kullanımda karşılaşılmayabilir.