» Etiket
llm
423 yayınLLM Yargıcı: Puanları Toplamadan İkili Kontrollerle Değerlendirme
LLM değerlendirmelerinde ikili kontroller ve tek yargı kullanmanın avantajları. Mühendisler için güvenilir bir kalite değerlendirme yöntemi.
Vercel AI SDK 6'da 'agent' aslında bir while döngüsü
AI SDK 6'daki ToolLoopAgent ve stopWhen mekanizmasının kod seviyesinde nasıl çalıştığı, mock model testleriyle adım adım incelendi.
Ghost Vessel: Yerel AI Ajanına Sohbet Yerine Yüz Takıldı
Geliştirici, yerel LLM ajanı için Telegram sohbetini video görüşme tarzı bir avatarla değiştirdi. Ghost Vessel, GPU'yu modele bırakan önceden render edilmiş klip mimarisi ve duygu etiketleriyle çalışıyor, açık kaynak.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comAnthropic, Dil Modelinde Küresel Çalışma Alanı Keşfetti
Anthropic'in yeni J-lens tekniği, Claude gibi modellerde bilinç teorisindeki küresel çalışma alanına benzeyen bir iç temsil bölgesi ortaya koyuyor.
LLM Sağlayıcı Değiştirmeden Önce Neden Smoke Test Şart
Tek bir prompt göndermek LLM sağlayıcısını değiştirmek için yeterli değil. Timeout, streaming, rate limit ve tool-call davranışlarını test eden 10 dakikalık smoke test rehberi.
Mikrofinansta Çoklu Ajan Sistemleri: Yetki Sınırı ve Önyargı Denetimi
Afrika'daki mikrofinans ekosistemlerinde LLM ajanlarını güvenli hale getirmek için yetki sınırlama, önyargı denetimi ve paylaşılan durum mimarisi üzerine mühendislik desenleri.
LLM ajanları 20 yıllık web mimarisini zorluyor
Durum tabanlı ajanlar, stateless sunucu ve veritabanı üzerine kurulu klasik web mimarisinin sınırlarını zorluyor. Eksik olan parça: süreçlere adresle ulaşabilen bir routing primitifi.
Cruxible: Yapay Zeka Ajanları için Açık Kaynak Gerçek Katmanı
Cruxible, LLM ajanlarının belirsiz metin tabanlı hafızasına karşı deterministik ve denetlenebilir bir durum katmanı sunuyor. Apache-2.0 lisanslı, Python ve SQLite tabanlı.
ISNAD: Çok Ajanlı LLM Sistemleri için Güven Katmanı
ISNAD, çok ajanlı LLM sistemlerinde bilgi doğrulama için yeni bir güven katmanı sunuyor.
Yapay Zeka, İnsanlardan Daha Fazla Önyargı Geliştiriyor
Yapay zeka, işe alım süreçlerinde insanlardan daha fazla önyargı geliştirebiliyor. Araştırmalar, LLM'lerin bu durumu nasıl etkilediğini gösteriyor.