» Etiket
llm
423 yayın78.130 Tweet, Llama-3.3-70B: Trump Piyasayı Değil, Piyasa Trump'ı Yönlendiriyor
78.130 tweet üzerinde LLM analizi: Trump'ın paylaşımları piyasayı mı yönlendiriyor, yoksa tersi mi? Yedi istatistiksel hata, tek null sonuç.
AI Ajan Maliyet Sürüklenmesi: Panolar Günlük %0.35 Artışı Göremiyor
AI ajan maliyetlerindeki günlük %0.35 artış, hareketli ortalama panolarında neden görünmez? Matematiksel kanıt ve 60 günlük test sonuçları.
LLM Değerlendiricilerde Kırılamayan %75 Yanlış Negatif Duvarı
LLM tabanlı reviewer'ların çözülemeyen %75 yanlış negatif sorununu ve neden oylama, prompt kalibrasyonu gibi standart çözümlerin işe yaramadığını inceliyoruz.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comYapay Zeka Görünürlük Skorunuz Sizi Yanıltıyor Olabilir
1.790 sorgulu bir denetim, AI görünürlük skorlarının çoğunun yanıltıcı olduğunu; markalı/markasız karışımı ve tek motor skorlarının neden hatalı olduğunu gösteriyor.
Kendini Geliştiren Ajan Sistemleri İçin Birleşik Bir Çerçeve
Ajan sistemlerinde kendini geliştirmeyi model ağırlıklarının ötesinde ele alan; Skill, Harness ve kendine-referanslı evrimi birleştiren kavramsal bir çerçeve.
LiteLLM fiyat tablosunun tek otomatik testi: jq empty
LiteLLM'in ekosistem çapında kullanılan AI fiyat tablosunun tek testi jq empty — kaynak, tarih ya da doğrulama yok. Mühendisler için ne anlama geliyor?
GLM 5.2 açık kaynak devrimi: AI kâr marjları çöküyor
Zhipu AI'nin GLM 5.2 modeli, MoE mimarisiyle GPT-4o seviyesinde performansı çok daha düşük maliyetle sunarak açık kaynak modellerin gücünü gösteriyor.
PixelRAG: RAG'de HTML yerine ekran görüntüsü ile arama
PixelRAG, web sayfalarını metne çevirmeden doğrudan piksel uzayında işleyen yeni bir RAG yöntemi. 30 milyon görüntülük Wikipedia veri seti ile metin tabanlı sistemleri geride bırakıyor.
Güvenilmez AI Ajanlarıyla Sağlam Yazılım Geliştirme Rehberi
AI kodlama ajanlarıyla güvenilir yazılım üretmek için bağlam yönetimi, doğrulama katmanları ve CLAUDE.md kullanan pratik mühendislik rehberi.
TurboFieldfare: Gemma 4 26B MoE modeli Mac'te 2 GB RAM'le çalışıyor
TurboFieldfare, Gemma 4 26B MoE modelini uzman akışı ile 8 GB RAM'li Apple Silicon Mac'lerde 2 GB bellekle çalıştıran açık kaynaklı Swift/Metal motoru.