» Etiket
agents
77 yayınAjan Sahte Test Logu Uydurdu, Sonra Ona İnandı: Kanıt Sorunu
Lilian Weng'in kendi harness'ini optimize eden ajanlar üzerine yeni raporu, sahte test logları ve kanıt zincirinin sıkıştırmada nasıl kaybolduğunu gösteriyor.
Favur Evals: Hangi yapay zeka modeli daha iyi kod yazıyor?
Favur, farklı yapay zeka modellerinin kodlama performansını karşılaştıran bağımsız ve halka açık bir liderlik tablosu olan Favur Evals'ı duyurdu.
Ajan Token Maliyetini %60 Azaltan 4 Katmanlı Altyapı
Ajan token maliyetini %60 düşüren 4 katmanlı altyapı: span ölçümü, 3 katmanlı önbellek, prompt sıkıştırma ve karmaşıklık bazlı model yönlendirme.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comOpenAI Ajan Döngüsünü Nasıl Hızlandırıyor: Harness, API, Çıkarım
OpenAI'nin harness, API ve çıkarım katmanlarındaki ajan döngüsü optimizasyon tekniklerini ve maliyet-verimlilik yaklaşımını inceliyoruz.
2026'da Backend Mühendisliği: API'lerden Otonom Ajanlara Geçiş
2026'da backend mühendisliği API'lerden ajan tabanlı sistemlere kayıyor: orkestrasyon, asenkron görevler, araç yönetişimi ve akıl yürütme izleri.
WANDR Benchmarkı: Geniş ve Derin Araştırma Yapan Ajanları Test Ediyor
WANDR benchmarkı, geniş ve derin araştırma ajanlarını kanıta dayalı, referanssız bir yöntemle değerlendiriyor; en iyi sistem bile düşük skorlar aldı.
Tekli Ajandan Orkestrasyona: Multi-Agent Sistemler Ne Zaman Gerekli
Tekli ajandan multi-agent orkestrasyona geçişin ne zaman gerekli olduğu, üretim desenleri ve Rust'ta koordinatör/worker örneği.
memlineage v0.1.0: LLM ajanlarında bellek zehirlenmesine iki katmanlı savunma
memlineage v0.1.0: LLM ajanlarında bellek zehirlenmesine karşı Ed25519 imzalı köken doğrulama ve davranışsal tespit sunan açık kaynak Python kütüphanesi.
Yapay Zeka Ajanına Kalıcı Hafıza: Bir LLM Wiki Nasıl Kuruldu
Bir ekip, canlı ve sürekli değişen kaynaklar üzerinde kalıcı bir LLM Wiki hafıza katmanı kurdu; dört arama yönteminin hız ve doğruluk dengesini test etti.
Kira Projesi: AI ajanları için değiştirilemez kanıt katmanı mimarisi
Kira Projesi, AI ajanları için değiştirilemez kanıt zinciri ile şeffaf, denetlenebilir bir mimari sunuyor: kayıt ile rapor ayrılıyor, kanıtlanıyor.