» Etiket
llm
478 yayınKüçük eval setleri regresyonu yakalayamaz: istatistiksel güç sorunu
40-50 örneklik eval setleri regresyonların çoğunu kaçırır. İstatistiksel güç, Wilson aralığı ve ikili kriterlerle doğru ölçüm nasıl yapılır?
Generative AI İş İlanları Analizi: 95 Pozisyondan Çıkan Dersler
95 ABD merkezli Generative AI ilanının analizi: RAG ve agent birlikte anılıyor, Python-LLM-RAG kombinasyonu öne çıkıyor, maaşlar ve şirket dağılımı ortaya çıkıyor.
Kod ajanlarında bağlam iflası: stratejik unutmanın gerekliliği
Devasa bağlam pencereleri kod ajanlarını akıllandırmaz, aksine 'bağlam iflasına' sürükleyebilir. AST tabanlı budama ve dinamik ignore dosyalarıyla ajan güvenilirliğini artırma rehberi.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comAI Akış Yanıtlarında Sıfır Token Faturalama Hatası Nasıl Yakalanır
stream_billing_gate.py, AI akış yanıtlarında metin teslim edilip kullanım verisi kaybolduğunda faturalamanın sıfır kalmasını çevrimdışı tespit ediyor.
Yapay Zekada Asıl Fark: Büyük Bağlam Değil, Akıllı Mimari
Devasa context window'lar AI'ı çözmedi. ARC-AGI-3 testinde modeller %1'in altında kalırken, kazananlar artık modeli değil, etrafındaki sistemi tasarlıyor.
Tek Prompt Yerine Ajanik İş Akışları: LLM Kalitesini Artırma Rehberi
Chatbot benzeri tek prompt yaklaşımı yerine, LLM'lerde yansıma, araç kullanımı ve çoklu ajan devri gibi ajanik iş akışı desenleriyle daha güvenilir sonuçlar elde etme rehberi.
Yapay Zeka Ajanına Gerçekten İtiraz Ettirmek Neden Zor
Sadece eleştiri yapmakla görevli bir yapay zeka ajanı geliştirirken karşılaşılan zorluklar: modellerin doğal uyumluluk eğilimini kırmak için kullanılan prompt ve mimari teknikleri.
DevTeam AI: QwenCloud ile Çok Ajanlı Yazılım Ekibi
QwenCloud Global AI Hackathon için geliştirilen DevTeam AI, ürün fikrini 11 uzman AI ajanıyla tam bir yazılım teslim planına dönüştürüyor.
ZML/LLMD Alfa: CUDA'dan Apple Metal'e Tek LLM Sunucusu
ZML/LLMD alfa; LLaMa, Gemma, Qwen ve Mistral modellerini NVIDIA, AMD, TPU, Intel ve Apple Metal'de tek sunucuyla çalıştırıyor, DFlash ile hızlanma sağlıyor.
llama.garden: Nostr tabanlı merkeziyetsiz LLM torrent ağı
llama.garden, LLM ağırlıklarını torrent ile dağıtır; Nostr tabanlı katalog ve Hugging Face yedek sunucu desteğiyle seedersiz bile indirme sağlar.