» Etiket
coding-agents
11 yayınMiniMax M2.7: Kendi Eğitimini Optimize Eden Açık Kaynak AI
MiniMax'ın açık kaynaklı M2.7 modeli, eğitim sürecine bellek yazma ve beceri geliştirme yetkisiyle katılarak %30 verimlilik artışı sağladı; SWE-bench Pro'da GPT-5.3-Codex'i yakaladı.
Kod ajanlarında bağlam iflası: stratejik unutmanın gerekliliği
Devasa bağlam pencereleri kod ajanlarını akıllandırmaz, aksine 'bağlam iflasına' sürükleyebilir. AST tabanlı budama ve dinamik ignore dosyalarıyla ajan güvenilirliğini artırma rehberi.
OpenAI, kendi önerdiği SWE-Bench Pro'yu geçersiz ilan etti
OpenAI'nin yaptığı denetime göre SWE-Bench Pro görevlerinin yaklaşık %30'u kusurlu çıktı. Şirket, ajan tabanlı kodlama benchmark'ı için verdiği önceki tavsiyeyi geri çekti.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comDatabricks devasa kod tabanında AI kodlama ajanlarını test etti
Databricks, milyonlarca satırlık kod tabanında GLM, Claude ve GPT modellerini test ederek maliyet-performans dengesini ve harness etkisini analiz etti.
Jean2: Dosya Tabanlı Hafızayla Oturumlar Arası Gelişen Kodlama Ajanı
Jean2, opsiyonel hafıza, beceri ve oturum arama katmanlarıyla projeler hakkında öğrendiklerini markdown dosyalarına yazan bir kodlama ajanı. Zamanla model değil, bilgi birikimi gelişiyor.
Kod Temizliği Yapay Zeka Kodlama Ajanlarını Nasıl Etkiliyor?
Yeni bir araştırma, kod temizliğinin AI kodlama ajanlarının başarı oranını değil, token maliyetini ve verimliliğini etkilediğini gösteriyor.
Agent OS: Kod Üretim Modelleri İçin Açık Kaynak Kontrol Katmanı
Agent OS, kod üretim modellerini bellek, sandbox, doğrulama ve onay mekanizmalarıyla saran açık kaynaklı, yerel öncelikli bir yapay zeka ajan mimarisidir.
AI Ajanlarının Kurallara Uygunluğunu Test Eden Deney
AI ajanlarının kurallara uyumunu test eden deneyin sonuçları şaşırtıcıydı. Mekanik engellerin etkisi üzerine önemli veriler elde edildi.
Loop Engineering: Kod Ajanlarını Döngülerle Yönetmek
Kod ajanlarını tek tek yönlendirmek yerine onları otomatik çalıştıran döngüler tasarlamak, Codex ve Claude Code'da nasıl işliyor? Beş temel bileşenle inceledik.
Grok 4.5 ile Yapay Zeka Yarışı Sohbetten Ajanlara Kayıyor
xAI'nin Grok 4.5 modeli, yapay zeka rekabetinin sohbet botlarından araç kullanan, kod tabanında çalışan ajan iş akışlarına kaydığını gösteriyor. Geliştiriciler için ne değişiyor?