» Etiket
coding-agents
4 yayınKimi K3 testi: Çin modelleri kodlamada ucuz, planlamada değil
Kimi K3 benchmark testinde Çin yapay zeka modelleri planlamada pahalı, kodlamada ise 19 kat daha ucuz çıktı. Gerçek maliyet analizi.
Ajan Tabanlı Yazılım Mühendisliği: Spec Yetmez, Mimari Kayboluyor
Kodlama ajanlarının asıl zayıflığı kod üretimi değil; mimari hafıza kaybı ve spec-driven development'ın sınırları üzerine mühendislik analizi.
Yapay Zeka Kodlama Ajanları: Ağacın Dalını mı, Kökünü mü Alıyor?
SWE-bench ve METR verileri AI kodlama ajanlarının ilerleyişini gösteriyor; ama doğrulama maliyeti mühendislik için hâlâ belirleyici sınır.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comDeepSWE: AI Kodlama Ajanlarını Değerlendirmek İçin En İyi Ölçüt mü?
DeepSWE, AI kodlama ajanlarının performansını değerlendirmek için yenilikçi bir ölçüm platformudur.