» Etiket
local-ai
6 yayınHeadroom: Yerel AI için GPU bant genişliği tavanını tarayıcıda ölç
Headroom, WebGPU ile tarayıcıda GPU bellek bant genişliği tavanını ölçüp yerel AI tok/s performansını ve sürücü hatalarını gösteren açık araç.
Speculative Decoding: Yerel LLM'lerde Kullanılmayan Ücretsiz Hız Kazancı
Speculative decoding, yerel LLM çıktısını değiştirmeden 1.5-2.5 kat hızlandırıyor; 2026'da MTP ile modellere doğrudan entegre edildi.
Local Motion: Cursor ve VS Code için yerel LLM ajanı
Local Motion, Mac'te uyumlu bir yerel kodlama modelini otomatik seçip belleği yönetiyor; Cursor'a tünel üzerinden, VS Code'da ise tam yerel bağlanıyor.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comYerel Yapay Zeka: Bazı İşler Neden Cihazdan Çıkmamalı
Gizlilik, maliyet ve gecikme nedeniyle sık tekrarlanan AI görevleri yerelde çalıştırılmalı. Ollama ve faster-whisper ile kurulan pratik örnek.
llama.cpp'de DFlash: Qwen 3.6 27B'de 4.44 kat hız artışı
llama.cpp'ye eklenen DFlash, blok difüzyon tabanlı draft modeliyle Qwen 3.6 27B'de bağlam uzadıkça hızı artırıyor; 36K bağlamda 4.44 kat, kalite kaybı yok denecek kadar az.
Xllama: Xbox Series S'te Yerel LLM Sohbet ve Görüntü Üretimi
Xllama, Xbox Series S'te yerel LLM sohbeti ve Stable-Diffusion görüntü üretimi sunan bir uygulamadır.