» Etiket
gemma
8 yayınGemma-4 (2B/4B/12B) AWS Inferentia2'ye Nasıl Taşındı
Gemma-4'ün AWS Inferentia2'ye taşınması: karışık dikkat kafaları, KV paylaşımı ve NxD sharding sorunlarının çözümü.
TurboFieldfare: Gemma 4 26B MoE modeli Mac'te 2 GB RAM'le çalışıyor
TurboFieldfare, Gemma 4 26B MoE modelini uzman akışı ile 8 GB RAM'li Apple Silicon Mac'lerde 2 GB bellekle çalıştıran açık kaynaklı Swift/Metal motoru.
Gemma-4 (2B/4B/12B) AWS Inferentia2'ye Nasıl Taşındı
Gemma-4'ü AWS Inferentia2'ye taşıma raporu: karışık dikkat başlıkları, KV paylaşımı ve vLLM/NxD sınırlamalarının nasıl aşıldığı.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comDiffusionGemma: Google'ın Difüzyon Tabanlı LLM Rehberi
Google'ın DiffusionGemma geliştirici rehberi: çift yönlü dikkatli difüzyon tabanlı LLM, 4 kat hızlı üretim, vLLM desteği ve Sudoku ince ayar sonuçları.
Klişelerden Arındırılmış Gemma Modeli ile Hikaye Anlatımı
Gemma-4-26B-A4B-StyleTune-V2, klişelerden arındırılmış hikaye anlatımı için geliştirilmiş bir dil modelidir.
13 Yaşındaki Xeon ile GPU Olmadan Gemma 4 26B Çalıştırmak
Eski bir Xeon ile Gemma 4 26B modelini çalıştırmanın yollarını keşfedin.
Cactus Hybrid: Gemma 4'ü Yanlış Bildiğinde Bilgilendirmek İçin Eğittik
Cactus, Gemma 4 modelini yanılgı durumlarını tanıyacak şekilde geliştirdi. On-device model ile güvenilir yanıtlar sağlanıyor.
Trendyol'un ajanı LLM sunum ayarlarını 4 kat hızlandırdı
Trendyol Tech, autooptimizer adlı bir AI ajanıyla vLLM sunum ayarlarını insan müdahalesi olmadan optimize ederek Gemma 4 26B'de 4 kat performans artışı elde etti.