» Etiket
ai
223 yayınTaxCalcBench: Açık Kaynak Testte Yapay Zeka Vergi Hesaplıyor
TaxCalcBench, LLM'lerin gerçek vergi beyannamelerini doğru doldurup dolduramadığını ölçen açık kaynaklı bir test; en iyi model bile yüzde 54 doğruluk sağlıyor.
Java Kodunu AI İçin Obfuscate Etmeye Çalıştım, İşte Kırılanlar
Java kodunu AI'ya göndermeden önce obfuscate etme denemesi, Spring Data, JPA ve Lombok'un isim bağımlılıklarını gün yüzüne çıkardı.
Fine-Tuning Tıkandığında: Recall'u %45'ten %92'ye Taşıyan Mimari
Sağlık taleplerinde CPT/ICD kodlamasında %45 recall'da tıkanan bir LLM, deterministik NCCI doğrulama katmanıyla %92'ye ulaştı. Mimari ders burada.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comAI SDK v7'de Deprecated Erişimci Ajan Belleğini Sessizce Siliyor
AI SDK v7'de result.response.messages artık sadece son adımı döndürüyor; bu sessiz değişim çok turlu araç çağrılarını tarihçeden siliyor ve küçük modelleri çökertiyor.
Yerel Yapay Zeka: Bazı İşler Neden Cihazdan Çıkmamalı
Gizlilik, maliyet ve gecikme nedeniyle sık tekrarlanan AI görevleri yerelde çalıştırılmalı. Ollama ve faster-whisper ile kurulan pratik örnek.
Metis: Arm'ın açık kaynak ajanik güvenlik denetim aracı
Arm'ın Ürün Güvenliği Ekibi'nin geliştirdiği Metis, LLM tabanlı derin akıl yürütmeyle kod tabanlarında güvenlik açıklarını tespit eden açık kaynaklı bir çerçeve.
Unutulan Symlink: 'Çalışıyor' Bakımlı Olmakla Aynı Değildir
ai-assistant-dot-files deposunda Cursor için önceden kurulmuş ama unutulmuş symlink'ler, çalışan kodun bakımlı kod anlamına gelmediğini gösteriyor.
Yapay Zeka, Cloudflare'in CIRCL Kütüphanesinde 7 Hata Buldu
zkSecurity'nin AI denetim aracı Cloudflare'in CIRCL kütüphanesinde 7 kritik hata buldu; hepsi düzeltildi, çoğu HackerOne'da ödüllendirildi.
Yapay Zeka Ajan Döngüsünde Fatura Neden Katlanıyor
Token tasarrufu hileleri AI ajan maliyetini pek etkilemiyor; asıl patlama deneme sayısı, ajan turları ve paralel alt ajanlardan geliyor. Copilot örneğiyle tokenomiks tartışması.
OpenAI ve Broadcom'dan LLM'e özel çıkarım çipi Jalapeño
OpenAI ve Broadcom, dokuz ayda geliştirilen ilk özel LLM çıkarım çipi Jalapeño'yu tanıttı; gigawatt ölçekli veri merkezlerinde 2026'da devreye girecek.