» Etiket
ai-agents
67 yayınBun, Zig'den Rust'a: 64 Claude ajanıyla 2 günde tam yeniden yazım
Bun'ın Zig'den Rust'a geçişi: 64 paralel Claude ajanıyla 535.000 satır kod 2 günde yeniden yazıldı. Mühendisler için çıkarımlar.
Tek Ajanda 6 MCP Sunucusu: Gerçek Token Faturası Ne Çıktı
Altı MCP sunucusunu tek ajana bağlayan mühendis, token maliyetini, gecikmeyi ve OAuth sorunlarını ölçtü; %53 maliyet düşüşü sağlayan dört değişikliği paylaştı.
Review-Loop Engineering: Ajan Döngülerinde İnsan Denetimini Tasarlamak
Ajan kodlama döngülerinde insan denetimini gerçek kılan 'review-loop engineering' yaklaşımı: üç döngü, inceleme paketleri ve rubber-stamp riski.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comYapay Zekanın Sessiz İhmallerini Yakalayan Yeni Doğrulama Katmanı
Yapay zeka modellerinin öne sürmesi gereken iddiaları sessizce atlamasını yakalayan katmanlı bir doğrulama sistemi geliştirildi.
Claude Code Skills Rehberi: Geliştirme İş Akışını Otomatikleştirme
Claude Code Skills'in yeni dizin tabanlı yapısı, frontmatter alanları ve gerçek /code-review örneğiyle iş akışı otomasyonu rehberi.
Yapay Zeka Kodlamasında Doğru Ajanı Doğru Aşamada Kullanmak
Shape Up, OpenSpec ve ADR'leri birleştiren bu çerçeve, yapay zeka destekli kodlamada işi insan kararı, ajan taslağı ve otomasyon arasında ayırıyor.
AI Ajan Maliyet Sürüklenmesi: Panolar Günlük %0.35 Artışı Göremiyor
AI ajan maliyetlerindeki günlük %0.35 artış, hareketli ortalama panolarında neden görünmez? Matematiksel kanıt ve 60 günlük test sonuçları.
LLM Değerlendiricilerde Kırılamayan %75 Yanlış Negatif Duvarı
LLM tabanlı reviewer'ların çözülemeyen %75 yanlış negatif sorununu ve neden oylama, prompt kalibrasyonu gibi standart çözümlerin işe yaramadığını inceliyoruz.
Yapay Zekâ Ajanları Diff Tabanlı Kod İncelemesini Nasıl Geçersiz Kılıyor
Yapay zekâ kod ajanları diff tabanlı incelemeyi güvenilmez kılıyor; niyet artık test adları, builder API'leri ve kontrat testlerinde yaşıyor.
Değerlendirme Borcu: Ajan Testleri Neden Üretimde Çöküyor
Ajan değerlendirme araçlarının üretimde neden yetersiz kaldığını, çok-ajanlı sistemlerde büyüyen eval sorununu ve oturum tabanlı çözümü inceliyoruz.