» Etiket
gpu
91 yayınLinux 7.2 Yayınlandı: Önbellek Farkındalıklı Zamanlayıcı ve Daha Fazlası
Linux 7.2, önbellek farkındalıklı zamanlayıcı, adil GPU zamanlaması, USB4STREAM ve Btrfs iyileştirmeleriyle yayınlandı.
Dizüstülerde Sürekli Performans Açığı: Boost Clock Neden Yanıltır
Dizüstü bilgisayarlarda boost clock neden kısa sürer? Termal kısıtlama, PL1/PL2 güç limitleri ve TGP manipülasyonunun gerçek performansa etkisi.
AMD Instinct MI455X'i Duyurdu: CDNA 5 ve Helios Nvidia'ya Rakip Oluyor
AMD'nin CDNA 5 tabanlı Instinct MI455X GPU'su ve 72 GPU'luk Helios rack-scale mimarisi, Nvidia'nın Rubin platformuna karşı güçlü bir alternatif sunuyor.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comFFmpeg av1_vulkan Kodlayıcı: GPU'nuz AV1'i Destekliyor mu?
FFmpeg 8.x'teki av1_vulkan kodlayıcısını inceliyoruz: sürücü desteğini test etme, ilk encode denemesi, SVT-AV1 karşılaştırması ve container ortamında kullanım ipuçları.
CAKE: Yapay Zeka Ajanlarına Özel Derleyici Tasarımıyla Hızlı GPU Çekirdekleri
CAKE, yapay zeka ajanlarını donanıma özgü derleyici IR'ı ile birleştirerek B200'de ayarlanmış GPU çekirdek performansını geçiyor.
Metin Difüzyonu mu Otoregresif Model mi: GPU Kullanımının Gerçek Hesabı
Difüzyon tabanlı dil modelleri ile otoregresif modellerin GPU kullanım ekonomisi karşılaştırması: gecikme, batching ve gerçek token maliyeti.
Meta, GPU Duraksamalarını Azaltmak için BLOB Depolamayı Yeniden Yapılandırdı
Meta, GPU duraksamalarını ortadan kaldırmak için BLOB depolama mimarisini birleşik metadata ve doğrudan istemci akışıyla yeniden tasarladı.
Bw24: RTX 50 Serisi Blackwell için Sıfırdan Rust+CUDA Çıkarım Motoru
Bw24, RTX 50 serisi Blackwell GPU'lar için sıfırdan yazılmış Rust+CUDA çıkarım motoru; spekülatif kod çözmede llama.cpp'ye karşı 2,3 kata varan hız sunuyor.
GPU Mikroarşitektüründe AI Performansını Kısan Donanım Anahtarları
GPU mikroarşitektüründe AI performansını dinamik sınırlayan dört donanım anahtarı: düşük maliyetli, hızlı stabilize olan güvenlik mekanizması.
LLM Çıkarım Hızı: Darboğaz FLOPS Değil, Bellek Bant Genişliği
LLM çıkarımında gerçek darboğaz bellek bant genişliği. GPU, kuantizasyon ve batching seçimlerinin tok/s üzerindeki etkisini adım adım inceliyoruz.