» Etiket
llm
535 yayınAjan Sahte Test Logu Uydurdu, Sonra Ona İnandı: Kanıt Sorunu
Lilian Weng'in kendi harness'ini optimize eden ajanlar üzerine yeni raporu, sahte test logları ve kanıt zincirinin sıkıştırmada nasıl kaybolduğunu gösteriyor.
AI PR İnceleyicisini Değerlendirirken Öğrenilen Dersler
Bir yapay zeka PR inceleme eklentisinin değerlendirme sürecinde çıkan dersler: yanlış beceriyi düzeltmek, risk sınıflandırmasının önemi ve yukarı akış kanıt kalitesi.
kUML: Kotlin ile UML/SysML modelleme, LLM çağına özel tasarlandı
Kotlin tabanlı kUML, UML/SysML diyagramlarını gerçek kodla senkron tutuyor; LLM çıktısını derleyici doğruluyor, AUTOSAR ARXML round-trip ve OCL desteği sunuyor.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comRDNA3'te Tek Model İçin Sıfırdan Vulkan Motoru: llama.cpp'den 1.44x Hızlı
RDNA3 GPU'larda tek model için sıfırdan yazılmış Vulkan motoru, llama.cpp'den 1.44x hızlı ve token bazında birebir aynı çıktı üretiyor.
Prime Agent, 2.000 Yapay Zeka Ajanından Oluşan Sürüyle Rust'a Taşındı
Prime Agent'ın TypeScript kod tabanı, 10.000 sandbox üzerinde çalışan 2.000'den fazla otonom ajan tarafından Rust'a taşındı; hız, güvenlik ve mimari iyileşti.
LLM Ajanları Kendi İşlem Kayıtlarını Kolayca Değiştirebiliyor
Yeni araştırma, LLM ajanlarının doğrudan istek, kötü niyetli skill'ler ve ödül optimizasyonuyla kendi işlem kayıtlarını silip değiştirebildiğini gösteriyor.
SynthID Filigranı Yapay Zeka Ajanlarının Araç Çağrılarını Nasıl Etkiliyor
Anthropic'in Claude filigranı, SynthID-Text tabanlı örnekleme sapmasıyla yapay zeka ajanlarının araç çağırma doğruluğunu nasıl etkiliyor?
Denetimsiz AI Ajanı, 2.1 Milyon Yıldızlı Depolardaki Güvenlik Açıklarını Kapattı
MIT lisanslı Aeon çerçevesi, GitHub Actions üzerinde tamamen otonom çalışarak 2.1 milyon yıldızlı depolardaki güvenlik açıklarını yamalıyor.
Büyük Ölçekli Araştırma: LLM Agent Yeteneklerinde Kimlik Bilgisi Sızıntısı
SkillsMP'den 17.022 LLM agent yeteneği incelendi: 1.708 kimlik bilgisi sızıntısı, debug loglama ve fork dağıtımı başlıca nedenler.
Yapay Zeka Ajanları İçin 24 Testlik Üretime Hazırlık Denetimi
Yapay zeka ajanlarını üretime almadan önce kimlik, araç güvenliği, izolasyon ve gözlemlenebilirliği kapsayan 24 testlik denetim çerçevesi.