» Etiket
software-engineering
10 yayınKodun Çoğunu Yapay Zeka Yazınca İnceleme Süreci Nasıl Değişir
Claude gibi ajanlar kodun çoğunu yazınca klasik PR onayı anlamını kaybediyor; yeni kontrol modeli spesifikasyon ve doğrulama planına kayıyor.
Ajan Tabanlı Yazılım Mühendisliği: Spec Yetmez, Mimari Kayboluyor
Kodlama ajanlarının asıl zayıflığı kod üretimi değil; mimari hafıza kaybı ve spec-driven development'ın sınırları üzerine mühendislik analizi.
AI Çağında Kod Bolluğu: Apollo mu, Roket Motor Atölyesi mi?
AI'nın ucuzlattığı şey yalnızca kod üretimi; yargı ve entegrasyon hâlâ pahalı. Apollo ve Sovyet N1 roket programlarından mühendislik dersleri.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comKodun Maliyeti Çökünce Mühendislik Yönetimi Nasıl Değişmeli
Yapay zeka kod yazma maliyetini düşürdü ama mühendislik yönetimi pratiklerinin yarısı hâlâ geçerli. Hangi varsayımların çöktüğünü, hangilerinin çökmediğini analiz ediyoruz.
Yeni Ajan Sürüsü: Saniyede 1000 Commit ile Koordinasyon
Yapay zeka ajan sürülerinde planlayıcı-işçi mimarisi, özel versiyon kontrol sistemi ve saniyede 1000 commit ölçeğinde koordinasyon çözümleri incelendi.
Yazılım Fabrikaları: Döngüler, Kabuklar ve Karanlık Otomasyonun Bedeli
Döngü, kabuk ve fabrika: yazılım fabrikalarında karanlık otomasyonun getirdiği anlama borcu ve inceleme kapısının kritik rolü.
Yapay Zeka Kodlama Ajanları: Ağacın Dalını mı, Kökünü mü Alıyor?
SWE-bench ve METR verileri AI kodlama ajanlarının ilerleyişini gösteriyor; ama doğrulama maliyeti mühendislik için hâlâ belirleyici sınır.
Statgate: LLM Değerlendirmeleri için İstatistiksel Kalibre Kapıları
Statgate, LLM değerlendirmelerinde yanlış pozitifleri azaltan istatistiksel kapılar sunuyor.
Olay Tabanlı Sistemlerde Mesaj Kaybı: Tanıma Boşluğu
Olay tabanlı sistemlerde mesaj kaybı ve tanıma boşluğunun nedenleri ve çözümleri hakkında bilgi edinin.
DeepSWE: AI Kodlama Ajanlarını Değerlendirmek İçin En İyi Ölçüt mü?
DeepSWE, AI kodlama ajanlarının performansını değerlendirmek için yenilikçi bir ölçüm platformudur.