» Etiket
agents
24 yayınAI Ajanlarında İnsan Onayı Anını Doğru Tasarlamak
AI ajanının insana soru sorduğu an sıradan bir sohbet değil, sorumluluk devridir. Bildirim, onay ve devam akışını tasarlamak için pratik bir çerçeve sunuluyor.
GLM 5.2 açık kaynak devrimi: AI kâr marjları çöküyor
Zhipu AI'nin GLM 5.2 modeli, MoE mimarisiyle GPT-4o seviyesinde performansı çok daha düşük maliyetle sunarak açık kaynak modellerin gücünü gösteriyor.
Yapay zeka ajan hafızası: akıllı ama öğrenmeyen bir arşiv
Bugünkü AI ajan hafızası, geçmiş hatalardan öğrenmeyen gelişmiş bir arama sistemidir. Gerçek hafıza, sonuçlardan beslenen bir yargı mekanizması gerektirir.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comVetoBench: Yapay Zeka Ajanları Reddedilen Fikirleri Unutuyor mu?
VetoBench, hafıza sistemlerini klasik 'doğru öğe geldi mi' sorusu yerine 'reddedilen yaklaşım tekrar önerildi mi' sorusuyla test eden açık kaynaklı bir benchmark. Sonuçlar çarpıcı.
Ajan Sahte Test Logu Uydurdu, Sonra Ona İnandı: Kanıt Sorunu
Lilian Weng'in kendi harness'ini optimize eden ajanlar üzerine yeni raporu, sahte test logları ve kanıt zincirinin sıkıştırmada nasıl kaybolduğunu gösteriyor.
Kira Projesi: AI ajanları için değiştirilemez kanıt katmanı mimarisi
Kira Projesi, AI ajanları için değiştirilemez kanıt zinciri ile şeffaf, denetlenebilir bir mimari sunuyor: kayıt ile rapor ayrılıyor, kanıtlanıyor.
Yapay Zeka Ajanına Gerçekten İtiraz Ettirmek Neden Zor
Sadece eleştiri yapmakla görevli bir yapay zeka ajanı geliştirirken karşılaşılan zorluklar: modellerin doğal uyumluluk eğilimini kırmak için kullanılan prompt ve mimari teknikleri.
Vercel AI SDK 6'da 'agent' aslında bir while döngüsü
AI SDK 6'daki ToolLoopAgent ve stopWhen mekanizmasının kod seviyesinde nasıl çalıştığı, mock model testleriyle adım adım incelendi.
Bilgi ve Bellek Yönetimi: İlk Üç Yön Kesinleşti
Bilgi ve Bellek Yönetimi modülünde bellek deposu, bilgi grafiği adaptörü ve kalıcılık sözleşmeleri kesinleşti; API geriye uyumlu kalırken iç yapı yeniden yazıldı.
Claude Code'da Orkestrasyon: %46 Maliyetle %96 Performans
Anthropic'in Fable-Sonnet orkestrasyon deseni Claude Code'da yerel çalışıyor: %46 maliyetle %96 performans. Detaylar ve pilotfish paketi içeride.