» Etiket
software-engineering
75 yayınAraştırma: AI Kodlama Ajanı PR'larının %38,9'unda Güvenlik Açığı Var
AIDev veri setiyle yapılan çalışma, AI kodlama ajanı PR'larının %38,9'unda güvenlik açığı, kimlik bilgisi sızıntılarının çoğunun insan kaynaklı olduğunu ortaya koydu.
Armin Ronacher: Yapay zekâ ile kod ilerler, ekip ortak dili kaybeder
Armin Ronacher'ın Babil Kulesi metaforuyla yapay zekâ ajanlarının ekip içi ortak teknik dili nasıl aşındırdığını anlattığı deneme özeti.
Yazılım Fabrikaları: Döngüler, Kabuklar ve Karanlık Otomasyonun Bedeli
Döngü, kabuk ve fabrika: yazılım fabrikalarında karanlık otomasyonun getirdiği anlama borcu ve inceleme kapısının kritik rolü.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comFavur Evals: Hangi yapay zeka modeli daha iyi kod yazıyor?
Favur, farklı yapay zeka modellerinin kodlama performansını karşılaştıran bağımsız ve halka açık bir liderlik tablosu olan Favur Evals'ı duyurdu.
AI Tarafından Üretilen Kodu İncelerken Kullandığım Kontrol Listesi
AI üretimi kodun insan kodundan farklı bozulduğu yerleri ve inceleme sırasında öncelik verilmesi gereken üç kritik risk kategorisini inceliyoruz.
Eşzamanlı Ajan Yamalarını Taban Commit'e Göre Birleştirme
Eşzamanlı kod ajanı yamalarını taban commit, diff dijesti ve hunk sahipliğiyle belirlenimci biçimde birleştiren protokol ve test senaryosu.
eBPF Doğrulayıcı Hatalarını Çözmek: bpfix Aracı
eBPF doğrulayıcısının belirsiz hata mesajları onarımı zorlaştırıyor; bpfix, proof kaybının yerini bularak LLM destekli onarım başarısını %11-21 artırıyor.
AI Ajan Gecikmesi: Bekleme Süresini Derin Düşünmeye Çevirin
Mühendisler AI ajan bekleme sürelerini tükenmişlik yaratan izleme yerine bilinçli derin düşünme seanslarına nasıl çevirebilir?
30 Gün Boyunca Yapay Zeka Ekibinde Tek İnsan: 212 PR, Kırık CI
30 günlük yapay zeka ajan deneyi, kendi kendine 'yeşil' raporlayan CI ve incelenmemiş PR'ların kritik hataları nasıl gizlediğini gösteriyor.
Yapay Zeka Kodlama Ajanları: Ağacın Dalını mı, Kökünü mü Alıyor?
SWE-bench ve METR verileri AI kodlama ajanlarının ilerleyişini gösteriyor; ama doğrulama maliyeti mühendislik için hâlâ belirleyici sınır.