» Etiket
software-engineering
33 yayınReview-Loop Engineering: Ajan Döngülerinde İnsan Denetimini Tasarlamak
Ajan kodlama döngülerinde insan denetimini gerçek kılan 'review-loop engineering' yaklaşımı: üç döngü, inceleme paketleri ve rubber-stamp riski.
Yapay Zeka Kodlamasında Doğru Ajanı Doğru Aşamada Kullanmak
Shape Up, OpenSpec ve ADR'leri birleştiren bu çerçeve, yapay zeka destekli kodlamada işi insan kararı, ajan taslağı ve otomasyon arasında ayırıyor.
Kohezyon Serisi Tamamlandı: Beş Makale Bağımsız Değişim İlkesi'ne Bağlanıyor
Beş makalelik kohezyon serisi Zenodo'da tamamlandı: kohezyonun resmi tanımından Bağımsız Değişim İlkesi'ne (IVP) uzanan kanıtlanmış bir zincir.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comYapay Zekâ Ajanları Diff Tabanlı Kod İncelemesini Nasıl Geçersiz Kılıyor
Yapay zekâ kod ajanları diff tabanlı incelemeyi güvenilmez kılıyor; niyet artık test adları, builder API'leri ve kontrat testlerinde yaşıyor.
Araştırma: AI-DDoS açık kaynakta yeni katılımcı merge oranını %18 düşürdü
294 depo ve 2M+ PR üzerinde yapılan çalışma, AI üretimi katkıların açık kaynakta yeni katılımcı merge oranını %18,18 düşürdüğünü gösteriyor.
Kodlama Ajanlarını Model Değil, Harness Tasarımı İyileştiriyor
LangChain bir kodlama ajanını modeli değiştirmeden Terminal-Bench'te ilk 5'e taşıdı; kazanç tamamen harness tasarımından geldi.
Yapay Zekada Doğrulamanın Gerçek Sınırı: Kod mu, Muhakeme mi?
Bir AI ajanının 'hatırlarım' vaadinin boş çıkması, doğrulamanın neden kod tabanlı olması gerektiğini ve muhakemenin neden yetersiz kaldığını gösterdi.
Araştırma: AI Kodlama Ajanı PR'larının %38,9'unda Güvenlik Açığı Var
AIDev veri setiyle yapılan çalışma, AI kodlama ajanı PR'larının %38,9'unda güvenlik açığı, kimlik bilgisi sızıntılarının çoğunun insan kaynaklı olduğunu ortaya koydu.
Armin Ronacher: Yapay zekâ ile kod ilerler, ekip ortak dili kaybeder
Armin Ronacher'ın Babil Kulesi metaforuyla yapay zekâ ajanlarının ekip içi ortak teknik dili nasıl aşındırdığını anlattığı deneme özeti.
Favur Evals: Hangi yapay zeka modeli daha iyi kod yazıyor?
Favur, farklı yapay zeka modellerinin kodlama performansını karşılaştıran bağımsız ve halka açık bir liderlik tablosu olan Favur Evals'ı duyurdu.