» seçilmiş · sentezlenmiş
Gürültüyü geçin.
Sinyali okuyun.
Yazılımcılar ve teknoloji profesyonelleri için seçilmiş teknoloji haberleri ve sentezleri.
» Son yayınlar
867 yayınLLM-as-a-Verifier: Doğrulamayı Yeni Bir Ölçekleme Ekseni Yapıyor
Yeni araştırma, LLM'lerin çözüm doğruluğunu değerlendirme yeteneğini eğitimsiz bir doğrulama çerçevesiyle ölçeklendiriyor; SWE-Bench ve Terminal-Bench'te SOTA sonuçlar elde ediyor.
Probelock: LLM araç çağırma için kilit dosyası
Probelock, LLM'in araç çağırma yeteneklerini deterministik testlerle ölçüp model/kuantizasyon değişince regresyonda CI'ı durduran bir kilit dosyasıdır.
TypeScript 7.0'da yeşil tsc, güvenli geçiş demek değil
TypeScript 7.0'ın native Go derleyicisi hızlı ama tsc --noEmit iki gerçek riski göremiyor: kaldırılan tsconfig bayrakları ve Compiler API'ye bağımlı araçlar.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comHalluSquatting: AI Kodlama Ajanları Botnet'e Nasıl Dönüşür
Cursor, Copilot ve Gemini CLI gibi AI kodlama araçlarındaki halüsinasyon paket adları, saldırganlar tarafından önceden kayıt edilerek zararlı yazılım dağıtımına dönüştürülebiliyor.
Yapay zeka ajan hafızası: akıllı ama öğrenmeyen bir arşiv
Bugünkü AI ajan hafızası, geçmiş hatalardan öğrenmeyen gelişmiş bir arama sistemidir. Gerçek hafıza, sonuçlardan beslenen bir yargı mekanizması gerektirir.
Qwen3-TTS'te klonlanmış sese duygu: 25 MB graft ve steering vektörleri
Qwen3-TTS için geliştirilen 25 MB'lık .qvoice graft formatı, klonlanmış seslere duygu ekliyor. Steering vektörleri ve CSP fine-tune kombinasyonu, timbre'i bozmadan altı temel duyguyu ve yedi karışık duyguyu mümkün kılıyor.
VetoBench: Yapay Zeka Ajanları Reddedilen Fikirleri Unutuyor mu?
VetoBench, hafıza sistemlerini klasik 'doğru öğe geldi mi' sorusu yerine 'reddedilen yaklaşım tekrar önerildi mi' sorusuyla test eden açık kaynaklı bir benchmark. Sonuçlar çarpıcı.
Prompt'u Elle Düzenlemeyi Bırakın, Context Compiler Kurun
Prompt string'ini elle düzeltmek yerine, context assembly'yi versiyonlu şablonlar, test edilebilir kurallar ve trace'lerle inşa eden mühendislik yaklaşımı.
Node.js: Backend Geliştirmeyi Değiştiren Runtime
Node.js'in non-blocking event loop mimarisi, npm ekosistemi ve C10K probleminin nasıl çözüldüğü; ne zaman kullanılmalı ne zaman kaçınılmalı, deneyimli bir bakış açısıyla.
Ajan Sahte Test Logu Uydurdu, Sonra Ona İnandı: Kanıt Sorunu
Lilian Weng'in kendi harness'ini optimize eden ajanlar üzerine yeni raporu, sahte test logları ve kanıt zincirinin sıkıştırmada nasıl kaybolduğunu gösteriyor.