» Etiket
llm
478 yayınLLM Yargıcı: Puanları Toplamadan İkili Kontrollerle Değerlendirme
LLM değerlendirmelerinde ikili kontroller ve tek yargı kullanmanın avantajları. Mühendisler için güvenilir bir kalite değerlendirme yöntemi.
Vercel AI SDK 6'da 'agent' aslında bir while döngüsü
AI SDK 6'daki ToolLoopAgent ve stopWhen mekanizmasının kod seviyesinde nasıl çalıştığı, mock model testleriyle adım adım incelendi.
Ghost Vessel: Yerel AI Ajanına Sohbet Yerine Yüz Takıldı
Geliştirici, yerel LLM ajanı için Telegram sohbetini video görüşme tarzı bir avatarla değiştirdi. Ghost Vessel, GPU'yu modele bırakan önceden render edilmiş klip mimarisi ve duygu etiketleriyle çalışıyor, açık kaynak.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comAnthropic, Dil Modelinde Küresel Çalışma Alanı Keşfetti
Anthropic'in yeni J-lens tekniği, Claude gibi modellerde bilinç teorisindeki küresel çalışma alanına benzeyen bir iç temsil bölgesi ortaya koyuyor.
LLM Sağlayıcı Değiştirmeden Önce Neden Smoke Test Şart
Tek bir prompt göndermek LLM sağlayıcısını değiştirmek için yeterli değil. Timeout, streaming, rate limit ve tool-call davranışlarını test eden 10 dakikalık smoke test rehberi.
Mikrofinansta Çoklu Ajan Sistemleri: Yetki Sınırı ve Önyargı Denetimi
Afrika'daki mikrofinans ekosistemlerinde LLM ajanlarını güvenli hale getirmek için yetki sınırlama, önyargı denetimi ve paylaşılan durum mimarisi üzerine mühendislik desenleri.
LLM ajanları 20 yıllık web mimarisini zorluyor
Durum tabanlı ajanlar, stateless sunucu ve veritabanı üzerine kurulu klasik web mimarisinin sınırlarını zorluyor. Eksik olan parça: süreçlere adresle ulaşabilen bir routing primitifi.
Cruxible: Yapay Zeka Ajanları için Açık Kaynak Gerçek Katmanı
Cruxible, LLM ajanlarının belirsiz metin tabanlı hafızasına karşı deterministik ve denetlenebilir bir durum katmanı sunuyor. Apache-2.0 lisanslı, Python ve SQLite tabanlı.
Açık bir ajan güvenlik benchmark'ı: Yakalanamayan saldırılar
Modern LLM ajanlarına yönelik 497 saldırıyı içeren açık bir güvenlik benchmark'ı oluşturuldu.
LLM Kullanımında Bağlam Mühendisliği
Bağlam mühendisliği, LLM'nin alan bilgisi ile optimize edilmesini sağlıyor. Daha doğru yanıtlar için indeks kullanımı.