» Etiket
llm
423 yayınCPU'da LLM: hız kazandıran kuantizasyon değil, metin formatı
Ücretsiz ARM CPU sunucusunda ölçüldü: prompt'u 'etiket: değer' formatına çevirmek LLM prefill süresini 6,5 kat kısalttı, kuantizasyon hileleri doğruluğu düşürdü.
Open Minis: iOS için Siri AI'nin Olması Gereken Ajan Deneyimi
Open Minis, iOS'ta Apple API'lerini bir Linux kabuğuyla birleştirerek kendi kendini geliştiren, gerçek bir ajan deneyimi sunuyor.
Mozilla Raporu: Açık Kaynak AI Token'larda Önde, Üretimde Geride
Mozilla'nın 2026 raporu: açık kaynak AI modelleri token hacminde önde ama üretim dağıtımında kapalı modellerin gerisinde kalıyor.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comTek Ajanda 6 MCP Sunucusu: Gerçek Token Faturası Ne Çıktı
Altı MCP sunucusunu tek ajana bağlayan mühendis, token maliyetini, gecikmeyi ve OAuth sorunlarını ölçtü; %53 maliyet düşüşü sağlayan dört değişikliği paylaştı.
mcpgrade testi: 36 MCP sunucusunun üçte biri D/F aldı
mcpgrade aracı 36 MCP sunucusunu taradı: üçte biri D/F aldı. Eksik parametre açıklamaları ve model testleri ajan kullanılabilirliğini nasıl etkiliyor?
Android'de llama.cpp KV Durumuyla TTFT 9,9x Azaldı
EdgeSync-LLM, llama.cpp KV API'leriyle tekrar prompt işlemeden Android'de TTFT'yi 9,9x düşürdü; sahte 8,8x hızlanmayı da tespit edip eledi.
Cracken'dan Blacksea: LLM Tabanlı Saldırganları Tuzağa Düşüren Açık Kaynak Araç
Cracken'ın açık kaynak Blacksea aracı, LLM tabanlı siber saldırganları yem dosyalarla tuzağa düşürüp kod çalıştırma imkânı sağlıyor.
Çoklu Ajan Sistemlerinde Gizli Maliyet: Paralellik Değil, Bağlam Kirliliği
Çoklu alt-ajan oturumunda asıl maliyetin paralellik değil, orkestratörün bağlamına sızan ham transkriptler olduğu ortaya çıktı; bilişsel yerellik kavramı tanıtılıyor.
Fine-tuning Yok: Gerçekler Doğrudan Llama-3.1-8B Ağırlıklarına Elle Kodlandı
Llama-3.1-8B'ye fine-tuning, LoRA veya RAG olmadan, elle kodlanmış nöron devreleriyle gerçek ekleyen mekanistik yorumlanabilirlik projesi ve canlı görselleştirici.
Gigatoken: HuggingFace tokenizer'lardan ~1000x hızlı tokenizasyon
Gigatoken, HuggingFace tokenizers'a kıyasla ~1000x hızlı, Rust tabanlı drop-in tokenizasyon kütüphanesi; GB/s seviyesinde işleme sunuyor.