» Etiket
coding-agents
30 yayınHarness Mühendisliği: 11 Üretim Kodlama Ajanının Anatomisi
11 kodlama ajanı harness'ının kod incelemesi, ortak mimariyi, 29 tasarım desenini ve 2026'da araçtan platforma dönüşümü ortaya koyuyor.
SWE-Bench Pro'da Görevlerin %30'u Bozuksa, Skor Tablosuna Belirsizlik Payı Gerekir
OpenAI'nin SWE-Bench Pro denetimi görevlerin %30'unun bozuk olduğunu gösterdi; geçerlilik sürümleme ve belirsizlik aralığı için pratik rehber.
VM ve Sandbox Olmadan Çalışan Kodlama Ajanı: TypeScript'te Linux
RapidNative'in kodlama ajanı, VM veya sandbox kullanmadan; TypeScript'te yazılmış Lifo motoru ve pg-mem ile Linux benzeri araçları tek istekte çalıştırıyor.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comKimi K3 testi: Çin modelleri kodlamada ucuz, planlamada değil
Kimi K3 benchmark testinde Çin yapay zeka modelleri planlamada pahalı, kodlamada ise 19 kat daha ucuz çıktı. Gerçek maliyet analizi.
GhostCommit: AI kod inceleyicilerinin göremediği sızıntı
GhostCommit saldırısı, zararlı talimatları PNG görsellerine gizleyerek Cursor Bugbot ve CodeRabbit'i nasıl atlattığını gösteriyor.
Ajan Tabanlı Yazılım Mühendisliği: Spec Yetmez, Mimari Kayboluyor
Kodlama ajanlarının asıl zayıflığı kod üretimi değil; mimari hafıza kaybı ve spec-driven development'ın sınırları üzerine mühendislik analizi.
MiniMax M2.7: Kendi Eğitimini Optimize Eden Açık Kaynak AI
MiniMax'ın açık kaynaklı M2.7 modeli, eğitim sürecine bellek yazma ve beceri geliştirme yetkisiyle katılarak %30 verimlilik artışı sağladı; SWE-bench Pro'da GPT-5.3-Codex'i yakaladı.
Yerel Model Showdown 9. Tur: Qwen 3.6, Nemotron ve Qwythos Kod Testinde
RTX 5090'da llama.cpp ile beş LLM'in gerçek kodlama görevinde karşılaştırıldığı Local Model Showdown 9. tur analizi ve bulguları.
Prime Agent, 2.000 Yapay Zeka Ajanından Oluşan Sürüyle Rust'a Taşındı
Prime Agent'ın TypeScript kod tabanı, 10.000 sandbox üzerinde çalışan 2.000'den fazla otonom ajan tarafından Rust'a taşındı; hız, güvenlik ve mimari iyileşti.
Yerel Kodlama Ajanı: 70 Dakikada 13 Kesinti, Sorun Model Değildi
Yerelde çalışan bir kodlama ajanı 70 dakika boyunca 13 kez çöktü; sebep model değil, bağlam penceresi yapılandırma uyuşmazlığıydı.