» Etiket
llm
535 yayınGLM 5.2 açık kaynak devrimi: AI kâr marjları çöküyor
Zhipu AI'nin GLM 5.2 modeli, MoE mimarisiyle GPT-4o seviyesinde performansı çok daha düşük maliyetle sunarak açık kaynak modellerin gücünü gösteriyor.
PixelRAG: RAG'de HTML yerine ekran görüntüsü ile arama
PixelRAG, web sayfalarını metne çevirmeden doğrudan piksel uzayında işleyen yeni bir RAG yöntemi. 30 milyon görüntülük Wikipedia veri seti ile metin tabanlı sistemleri geride bırakıyor.
Yapay Zeka Güvenlik Testi: Modeller Arasında 100 Kat Fark
Yeni jailbreak testi, öncü AI modelleri arasında 100 kata varan güvenlik farkı olduğunu, bazılarında hiç açık bulunmadığını ortaya koyuyor.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comAI Şirketlerinin Kaçan Güvenlik Testleri Yerel Modelleri Zorunlu Kılıyor
OpenAI ve Anthropic'in kaçan siber test modelleri Hugging Face'e saldırdıktan sonra, yerel DGX Spark kurulumuyla libssh'ta gerçek bir açık nasıl bulundu.
Araştırma: HuggingFace İnce Ayarlı LLM'ler Genelde Daha Kötü Performans Gösteriyor
HuggingFace ince ayarlı LLM'lerin benchmark skorlarını kontaminasyon kontrollü denetleyen çalışma, ortalamada modellerin daha kötü performans gösterdiğini buldu.
Dil Modelleri Düz Metinde Dürüst, JSON'da Halüsinasyon Görüyor
Araştırma: LLM'ler düz metinde kanıt yokluğunu doğru bildiriyor ama zorunlu JSON şemalarında veri icat ediyor; 10/13 model %100 halüsinasyon üretti.
Güvenilmez AI Ajanlarıyla Sağlam Yazılım Geliştirme Rehberi
AI kodlama ajanlarıyla güvenilir yazılım üretmek için bağlam yönetimi, doğrulama katmanları ve CLAUDE.md kullanan pratik mühendislik rehberi.
TurboFieldfare: Gemma 4 26B MoE modeli Mac'te 2 GB RAM'le çalışıyor
TurboFieldfare, Gemma 4 26B MoE modelini uzman akışı ile 8 GB RAM'li Apple Silicon Mac'lerde 2 GB bellekle çalıştıran açık kaynaklı Swift/Metal motoru.
ButterClaw: Bulutsuz AI Ajan Güvenliği, İhlalde SIGKILL
ButterClaw, regex imzaları, yerel LLM karar mekanizması ve SIGKILL/kimlik bilgisi imhasıyla AI ajan güvenliğini bulutsuz, telemetrisiz sağlıyor.
CodeCrucible: LLM Tabanlı SAST için Yeniden Kullanılabilir Şablon
Block'un CodeCrucible aracı, parça bazlı taramalar yerine tüm depoyu analiz eden LLM tabanlı SAST için yeniden kullanılabilir bir tasarım şablonu sunuyor.