» Etiket
qwen
14 yayınSwarmLLM: Tarayıcı Sekmelerinde Eşler Arası LLM Çıkarımı
SwarmLLM, WebRTC ve özel WebGPU motoruyla Qwen 3.8 27B'yi tarayıcı sekmelerinde cihazlar arasında paylaştırarak kurulumsuz LLM çıkarımı sağlıyor.
Kapalı Claude Yerine Açık Qwen'e Canlı Düşünce İzleyici
Anthropic'in workspace makalesi ilham verdi; bir geliştirici Claude yerine açık Qwen modeli için canlı, token bazlı bir iç düşünce izleyici geliştirdi.
Yapay Zekalar Anlaşamayınca: Qwen-Max ile Çok Ajanlı Kod İncelemesi
ShiftLeft Society, iki yapay zeka incelemecinin bütçe maliyetiyle müzakere ettiği bir sistem kurdu; Qwen-Max tabanlı bu tribünal doğruluğu %82,5'ten %95'e çıkardı.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comQwen 3.8-Max ve Claude Opus 5: Skorlar Faturayı Tahmin Etmiyor
Qwen 3.8-Max ve Claude Opus 5 örnekleri, token fiyatının artık gerçek maliyeti göstermediğini, başarılı görev başına maliyetin neden önemli olduğunu gösteriyor.
Yerel Model Showdown 9. Tur: Qwen 3.6, Nemotron ve Qwythos Kod Testinde
RTX 5090'da llama.cpp ile beş LLM'in gerçek kodlama görevinde karşılaştırıldığı Local Model Showdown 9. tur analizi ve bulguları.
Qwen kendi uygulamasını yazdı: QuotePilot'ta insan onayı şart kaldı
Qwen modelleriyle hem çalışan hem büyük ölçüde yazılan QuotePilot projesi: insan onay noktası, Decimal aritmetik ve gerçek geliştirme hataları.
Yerel Kodlama Ajanı: 70 Dakikada 13 Kesinti, Sorun Model Değildi
Yerelde çalışan bir kodlama ajanı 70 dakika boyunca 13 kez çöktü; sebep model değil, bağlam penceresi yapılandırma uyuşmazlığıydı.
Qwen3.6-35B-A3B ile 4× Intel Arc Pro B70: 200 tok/s Performans
Qwen3.6-35B-A3B, 4 Intel Arc Pro B70 ile optimize edilmiş dört yapılandırma sunuyor. Performans ve esneklik için ideal çözümler.
Ninfer: Tek GPU ile yüksek performanslı çıkarım
NInfer, RTX 5090 üzerinde yüksek performanslı çıkarım için C++/CUDA motoru sunuyor.
llama.cpp'de DFlash: Qwen 3.6 27B'de 4.44 kat hız artışı
llama.cpp'ye eklenen DFlash, blok difüzyon tabanlı draft modeliyle Qwen 3.6 27B'de bağlam uzadıkça hızı artırıyor; 36K bağlamda 4.44 kat, kalite kaybı yok denecek kadar az.