» Etiket
gpu
82 yayınDizüstülerde Sürekli Performans Açığı: Boost Clock Neden Yanıltır
Dizüstü bilgisayarlarda boost clock neden kısa sürer? Termal kısıtlama, PL1/PL2 güç limitleri ve TGP manipülasyonunun gerçek performansa etkisi.
AMD Instinct MI455X'i Duyurdu: CDNA 5 ve Helios Nvidia'ya Rakip Oluyor
AMD'nin CDNA 5 tabanlı Instinct MI455X GPU'su ve 72 GPU'luk Helios rack-scale mimarisi, Nvidia'nın Rubin platformuna karşı güçlü bir alternatif sunuyor.
FFmpeg av1_vulkan Kodlayıcı: GPU'nuz AV1'i Destekliyor mu?
FFmpeg 8.x'teki av1_vulkan kodlayıcısını inceliyoruz: sürücü desteğini test etme, ilk encode denemesi, SVT-AV1 karşılaştırması ve container ortamında kullanım ipuçları.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comCAKE: Yapay Zeka Ajanlarına Özel Derleyici Tasarımıyla Hızlı GPU Çekirdekleri
CAKE, yapay zeka ajanlarını donanıma özgü derleyici IR'ı ile birleştirerek B200'de ayarlanmış GPU çekirdek performansını geçiyor.
Metin Difüzyonu mu Otoregresif Model mi: GPU Kullanımının Gerçek Hesabı
Difüzyon tabanlı dil modelleri ile otoregresif modellerin GPU kullanım ekonomisi karşılaştırması: gecikme, batching ve gerçek token maliyeti.
Meta, GPU Duraksamalarını Azaltmak için BLOB Depolamayı Yeniden Yapılandırdı
Meta, GPU duraksamalarını ortadan kaldırmak için BLOB depolama mimarisini birleşik metadata ve doğrudan istemci akışıyla yeniden tasarladı.
Bw24: RTX 50 Serisi Blackwell için Sıfırdan Rust+CUDA Çıkarım Motoru
Bw24, RTX 50 serisi Blackwell GPU'lar için sıfırdan yazılmış Rust+CUDA çıkarım motoru; spekülatif kod çözmede llama.cpp'ye karşı 2,3 kata varan hız sunuyor.
GPU Mikroarşitektüründe AI Performansını Kısan Donanım Anahtarları
GPU mikroarşitektüründe AI performansını dinamik sınırlayan dört donanım anahtarı: düşük maliyetli, hızlı stabilize olan güvenlik mekanizması.
LLM Çıkarım Hızı: Darboğaz FLOPS Değil, Bellek Bant Genişliği
LLM çıkarımında gerçek darboğaz bellek bant genişliği. GPU, kuantizasyon ve batching seçimlerinin tok/s üzerindeki etkisini adım adım inceliyoruz.
LLM Çıkarımının Enerji Maliyeti: LLaMA Üzerinde Ölçüm
Araştırmacılar, LLaMA modelinin farklı boyutlarını V100 ve A100 GPU'larda test ederek LLM çıkarımının enerji ve hesaplama maliyetini analiz etti.