» Etiket
coding-agents
30 yayınSophos: Kodlama Asistanları Saldırgan Tespit Kurallarını Tetikliyor
Sophos raporu: Claude Code, Cursor ve Codex, EDR'nin saldırganları yakalamak için tasarlanmış kurallarını tetikliyor. Operatörler için öneriler.
Yapay Zeka Kodlama Ajanları: Ağacın Dalını mı, Kökünü mü Alıyor?
SWE-bench ve METR verileri AI kodlama ajanlarının ilerleyişini gösteriyor; ama doğrulama maliyeti mühendislik için hâlâ belirleyici sınır.
Harness Engineering: Yapay Zeka Ajanlarını Bağlamla Güçlendirmek
Harness engineering, yapay zeka modelini sabit tutup bağlam ve araçları optimize ederek güvenilir ajan çıktıları için gereksinimleri kodlar.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comKodlama Ajanları İçin Döngü Tasarımı: Hedef, Doğrulama, Durdurma
Kodlama ajanlarında hedef, doğrulama ve durdurma döngüsü nasıl tasarlanır? Verifikasyon merdiveni, izole denemeler ve sonlanma durumları üzerine rehber.
AI Kodlama Ajanları İçin Etkili İnsan Denetimi Nasıl Kurulur
AI kodlama ajanlarında onay prompları neden yetersiz kalır? Eylemleri risk derecesine göre sınıflandırıp doğru kontrolü eşleştiren pratik yaklaşım.
Kod ajanlarında bağlam iflası: stratejik unutmanın gerekliliği
Devasa bağlam pencereleri kod ajanlarını akıllandırmaz, aksine 'bağlam iflasına' sürükleyebilir. AST tabanlı budama ve dinamik ignore dosyalarıyla ajan güvenilirliğini artırma rehberi.
OpenAI, kendi önerdiği SWE-Bench Pro'yu geçersiz ilan etti
OpenAI'nin yaptığı denetime göre SWE-Bench Pro görevlerinin yaklaşık %30'u kusurlu çıktı. Şirket, ajan tabanlı kodlama benchmark'ı için verdiği önceki tavsiyeyi geri çekti.
Databricks devasa kod tabanında AI kodlama ajanlarını test etti
Databricks, milyonlarca satırlık kod tabanında GLM, Claude ve GPT modellerini test ederek maliyet-performans dengesini ve harness etkisini analiz etti.
Jean2: Dosya Tabanlı Hafızayla Oturumlar Arası Gelişen Kodlama Ajanı
Jean2, opsiyonel hafıza, beceri ve oturum arama katmanlarıyla projeler hakkında öğrendiklerini markdown dosyalarına yazan bir kodlama ajanı. Zamanla model değil, bilgi birikimi gelişiyor.
Kod Temizliği Yapay Zeka Kodlama Ajanlarını Nasıl Etkiliyor?
Yeni bir araştırma, kod temizliğinin AI kodlama ajanlarının başarı oranını değil, token maliyetini ve verimliliğini etkilediğini gösteriyor.