» Etiket
agents
31 yayınEngrava: Yapay Zeka Ajanları İçin SQLite Tabanlı Deterministik Bellek Kütüphanesi
Engrava, ajan belleğini SQLite'ta tipli graf olarak saklayan, LLM yeniden yazımı yerine deterministik konsolidasyon kullanan MIT lisanslı Python kütüphanesi.
VetoBench: Ajan Belleği Reddedilen Kararları Hatırlıyor mu?
VetoBench, ajan bellek sistemlerinin reddedilen kararları (vetoları) hatırlayıp hatırlamadığını test eden açık kaynaklı bir kıyaslama.
32 Gerçek AI Ajan Hatası Kataloglandı, Kapsam Dışılar da Açıklandı
ARE Incident Database, OWASP ASI Top 10'a eşlenen 32 gerçek AI ajan hatasını çalıştırılabilir kod örnekleri ve dürüst kapsam boşluklarıyla listeliyor.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comAgent Araç Çağrılarında Boş Sonucu Kim Yorumlar?
Agent araç çağrılarında boş sonuçların üç farklı kök nedeni ve bunları ayırt etmek için tipik durum, kanıt ve retry_after tasarımı.
Favur Evals: Hangi yapay zeka modeli daha iyi kod yazıyor?
Favur, farklı yapay zeka modellerinin kodlama performansını karşılaştıran bağımsız ve halka açık bir liderlik tablosu olan Favur Evals'ı duyurdu.
Ajan Token Maliyetini %60 Azaltan 4 Katmanlı Altyapı
Ajan token maliyetini %60 düşüren 4 katmanlı altyapı: span ölçümü, 3 katmanlı önbellek, prompt sıkıştırma ve karmaşıklık bazlı model yönlendirme.
WANDR Benchmarkı: Geniş ve Derin Araştırma Yapan Ajanları Test Ediyor
WANDR benchmarkı, geniş ve derin araştırma ajanlarını kanıta dayalı, referanssız bir yöntemle değerlendiriyor; en iyi sistem bile düşük skorlar aldı.
Tekli Ajandan Orkestrasyona: Multi-Agent Sistemler Ne Zaman Gerekli
Tekli ajandan multi-agent orkestrasyona geçişin ne zaman gerekli olduğu, üretim desenleri ve Rust'ta koordinatör/worker örneği.
memlineage v0.1.0: LLM ajanlarında bellek zehirlenmesine iki katmanlı savunma
memlineage v0.1.0: LLM ajanlarında bellek zehirlenmesine karşı Ed25519 imzalı köken doğrulama ve davranışsal tespit sunan açık kaynak Python kütüphanesi.
Yapay Zeka Ajanına Kalıcı Hafıza: Bir LLM Wiki Nasıl Kuruldu
Bir ekip, canlı ve sürekli değişen kaynaklar üzerinde kalıcı bir LLM Wiki hafıza katmanı kurdu; dört arama yönteminin hız ve doğruluk dengesini test etti.