» Etiket
agents
77 yayınAI Ajanlarında İnsan Onayı Anını Doğru Tasarlamak
AI ajanının insana soru sorduğu an sıradan bir sohbet değil, sorumluluk devridir. Bildirim, onay ve devam akışını tasarlamak için pratik bir çerçeve sunuluyor.
GLM 5.2 açık kaynak devrimi: AI kâr marjları çöküyor
Zhipu AI'nin GLM 5.2 modeli, MoE mimarisiyle GPT-4o seviyesinde performansı çok daha düşük maliyetle sunarak açık kaynak modellerin gücünü gösteriyor.
Statik Tarayıcı AI Ajan Framework'lerinde 30 Korumasız Yıkıcı Eylem Buldu
Açık kaynaklı bir tarayıcı, 25 AI ajan framework'ünde modellerin yetkilendirme kontrolü olmadan silme, deploy ve webhook çağırabildiği 30 gerçek bulgu tespit etti.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comEngrava: Yapay Zeka Ajanları İçin SQLite Tabanlı Deterministik Bellek Kütüphanesi
Engrava, ajan belleğini SQLite'ta tipli graf olarak saklayan, LLM yeniden yazımı yerine deterministik konsolidasyon kullanan MIT lisanslı Python kütüphanesi.
VetoBench: Ajan Belleği Reddedilen Kararları Hatırlıyor mu?
VetoBench, ajan bellek sistemlerinin reddedilen kararları (vetoları) hatırlayıp hatırlamadığını test eden açık kaynaklı bir kıyaslama.
Claude Science İncelemesi: Daemon Tabanlı Ajan Mimarisi
Claude Science'ın daemon tabanlı host RPC mimarisi, kernel-daemon yetki ayrımı ve ajan harness tasarımı üzerine teknik inceleme.
32 Gerçek AI Ajan Hatası Kataloglandı, Kapsam Dışılar da Açıklandı
ARE Incident Database, OWASP ASI Top 10'a eşlenen 32 gerçek AI ajan hatasını çalıştırılabilir kod örnekleri ve dürüst kapsam boşluklarıyla listeliyor.
Agent Araç Çağrılarında Boş Sonucu Kim Yorumlar?
Agent araç çağrılarında boş sonuçların üç farklı kök nedeni ve bunları ayırt etmek için tipik durum, kanıt ve retry_after tasarımı.
Yapay zeka ajan hafızası: akıllı ama öğrenmeyen bir arşiv
Bugünkü AI ajan hafızası, geçmiş hatalardan öğrenmeyen gelişmiş bir arama sistemidir. Gerçek hafıza, sonuçlardan beslenen bir yargı mekanizması gerektirir.
VetoBench: Yapay Zeka Ajanları Reddedilen Fikirleri Unutuyor mu?
VetoBench, hafıza sistemlerini klasik 'doğru öğe geldi mi' sorusu yerine 'reddedilen yaklaşım tekrar önerildi mi' sorusuyla test eden açık kaynaklı bir benchmark. Sonuçlar çarpıcı.