» Etiket
ai
1046 yayınDatabricks devasa kod tabanında AI kodlama ajanlarını test etti
Databricks, milyonlarca satırlık kod tabanında GLM, Claude ve GPT modellerini test ederek maliyet-performans dengesini ve harness etkisini analiz etti.
Jean2: Dosya Tabanlı Hafızayla Oturumlar Arası Gelişen Kodlama Ajanı
Jean2, opsiyonel hafıza, beceri ve oturum arama katmanlarıyla projeler hakkında öğrendiklerini markdown dosyalarına yazan bir kodlama ajanı. Zamanla model değil, bilgi birikimi gelişiyor.
TaxCalcBench: Açık Kaynak Testte Yapay Zeka Vergi Hesaplıyor
TaxCalcBench, LLM'lerin gerçek vergi beyannamelerini doğru doldurup dolduramadığını ölçen açık kaynaklı bir test; en iyi model bile yüzde 54 doğruluk sağlıyor.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comJava Kodunu AI İçin Obfuscate Etmeye Çalıştım, İşte Kırılanlar
Java kodunu AI'ya göndermeden önce obfuscate etme denemesi, Spring Data, JPA ve Lombok'un isim bağımlılıklarını gün yüzüne çıkardı.
Fine-Tuning Tıkandığında: Recall'u %45'ten %92'ye Taşıyan Mimari
Sağlık taleplerinde CPT/ICD kodlamasında %45 recall'da tıkanan bir LLM, deterministik NCCI doğrulama katmanıyla %92'ye ulaştı. Mimari ders burada.
AI SDK v7'de Deprecated Erişimci Ajan Belleğini Sessizce Siliyor
AI SDK v7'de result.response.messages artık sadece son adımı döndürüyor; bu sessiz değişim çok turlu araç çağrılarını tarihçeden siliyor ve küçük modelleri çökertiyor.
Yerel Yapay Zeka: Bazı İşler Neden Cihazdan Çıkmamalı
Gizlilik, maliyet ve gecikme nedeniyle sık tekrarlanan AI görevleri yerelde çalıştırılmalı. Ollama ve faster-whisper ile kurulan pratik örnek.
Metis: Arm'ın açık kaynak ajanik güvenlik denetim aracı
Arm'ın Ürün Güvenliği Ekibi'nin geliştirdiği Metis, LLM tabanlı derin akıl yürütmeyle kod tabanlarında güvenlik açıklarını tespit eden açık kaynaklı bir çerçeve.
Unutulan Symlink: 'Çalışıyor' Bakımlı Olmakla Aynı Değildir
ai-assistant-dot-files deposunda Cursor için önceden kurulmuş ama unutulmuş symlink'ler, çalışan kodun bakımlı kod anlamına gelmediğini gösteriyor.
Yapay Zeka, Cloudflare'in CIRCL Kütüphanesinde 7 Hata Buldu
zkSecurity'nin AI denetim aracı Cloudflare'in CIRCL kütüphanesinde 7 kritik hata buldu; hepsi düzeltildi, çoğu HackerOne'da ödüllendirildi.