» Etiket
ai-agents
246 yayınYapay Zekanın Sessiz İhmallerini Yakalayan Yeni Doğrulama Katmanı
Yapay zeka modellerinin öne sürmesi gereken iddiaları sessizce atlamasını yakalayan katmanlı bir doğrulama sistemi geliştirildi.
Claude Code Skills Rehberi: Geliştirme İş Akışını Otomatikleştirme
Claude Code Skills'in yeni dizin tabanlı yapısı, frontmatter alanları ve gerçek /code-review örneğiyle iş akışı otomasyonu rehberi.
AI Ajan Runtime Politikası: Tehlikeli Araç Çağrılarını Durdurun
AI ajanlarının tehlikeli araç çağrıları yapmasını önlemek için runtime politika katmanı: risk seviyeleri, yetki devri ve doğrulama kuralları.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comLLM Ajanlarına Terminal Erişimi Vermenin Gizli Riski
Otonom AI ajanlarına shell erişimi vermek dosya sistemini bozabilir. OverlayFS tabanlı rewind-sdk, milisaniyeler içinde checkpoint ve rollback sağlıyor.
Refactoring, AI Ajanlarının Token Maliyetini %83 Düşürüyor
Ajan tabanlı bir kod tabanında yapılan refactoring deneyi, tekrarlayan değişikliklerde girdi token maliyetini %83 azalttı.
Raft, Ajanlar İçin Bildirim Mimarisini Neden Yeniden Tasarladı
Raft ekibi, yapay zeka ajanlarının insanlar gibi mesaj görmezden gelemediğini keşfedip bildirim mimarisini ve önbellek tasarımını yeniden kurdu.
NMEMORY: Kanıt Yoksa Konuşmayan Yapay Zeka Ajan Belleği
NMEMORY, MCP üzerinden çalışan, kanıt olmadan yanıt vermeyen, tamamen yerel ve ağa kapalı bir AI ajan bellek sistemi. Rust, SQLite, 21 MCP aracı.
Yapay Zeka Kodlamasında Doğru Ajanı Doğru Aşamada Kullanmak
Shape Up, OpenSpec ve ADR'leri birleştiren bu çerçeve, yapay zeka destekli kodlamada işi insan kararı, ajan taslağı ve otomasyon arasında ayırıyor.
AI Ajan Maliyet Sürüklenmesi: Panolar Günlük %0.35 Artışı Göremiyor
AI ajan maliyetlerindeki günlük %0.35 artış, hareketli ortalama panolarında neden görünmez? Matematiksel kanıt ve 60 günlük test sonuçları.
LLM Değerlendiricilerde Kırılamayan %75 Yanlış Negatif Duvarı
LLM tabanlı reviewer'ların çözülemeyen %75 yanlış negatif sorununu ve neden oylama, prompt kalibrasyonu gibi standart çözümlerin işe yaramadığını inceliyoruz.