» Etiket
llm
28 yayınYapay Zeka Ajanlarını Güvenceye Almak: Güvenden Sınırlamaya
Otonom AI ajanları modelden aktöre dönüşürken güvenlik sınırı da değişiyor. OWASP'ın 2025 rehberliğine dayanan risk sınıfları ve sınırlama stratejileri.
PixelRAG: RAG'de HTML yerine ekran görüntüsü ile arama
PixelRAG, web sayfalarını metne çevirmeden doğrudan piksel uzayında işleyen yeni bir RAG yöntemi. 30 milyon görüntülük Wikipedia veri seti ile metin tabanlı sistemleri geride bırakıyor.
LLM-as-a-Verifier: Doğrulamayı Yeni Bir Ölçekleme Ekseni Yapıyor
Yeni araştırma, LLM'lerin çözüm doğruluğunu değerlendirme yeteneğini eğitimsiz bir doğrulama çerçevesiyle ölçeklendiriyor; SWE-Bench ve Terminal-Bench'te SOTA sonuçlar elde ediyor.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comProbelock: LLM araç çağırma için kilit dosyası
Probelock, LLM'in araç çağırma yeteneklerini deterministik testlerle ölçüp model/kuantizasyon değişince regresyonda CI'ı durduran bir kilit dosyasıdır.
HalluSquatting: AI Kodlama Ajanları Botnet'e Nasıl Dönüşür
Cursor, Copilot ve Gemini CLI gibi AI kodlama araçlarındaki halüsinasyon paket adları, saldırganlar tarafından önceden kayıt edilerek zararlı yazılım dağıtımına dönüştürülebiliyor.
eBPF Doğrulayıcı Hatalarını Çözmek: bpfix Aracı
eBPF doğrulayıcısının belirsiz hata mesajları onarımı zorlaştırıyor; bpfix, proof kaybının yerini bularak LLM destekli onarım başarısını %11-21 artırıyor.
LLM Quantization Rehberi: GPTQ, AWQ ve GGUF Karşılaştırması
Büyük dil modellerini 4-bit'e sıkıştırarak VRAM ihtiyacını düşüren quantization tekniklerini; GPTQ, AWQ, GGUF ve bitsandbytes yöntemlerini karşılaştırmalı olarak inceliyoruz.
CAI Dataset: Siber Güvenlikte En Büyük LLM Operatör Korpusu
CAI Dataset, 14 ayda toplanan 230 bin oturum ve 26 milyon promptla siber güvenlikte en büyük LLM operatör korpusunu sunuyor; gizlilik riski büyük.
StoryScope: Yapay Zekanın Anlatı İmzasını Ortaya Çıkarıyor
StoryScope, üslup yerine anlatı yapısına odaklanarak yapay zeka kurgusunu %93 doğrulukla tespit ediyor ve modele özgü anlatı imzalarını ortaya çıkarıyor.
Yapay Zekada Asıl Fark: Büyük Bağlam Değil, Akıllı Mimari
Devasa context window'lar AI'ı çözmedi. ARC-AGI-3 testinde modeller %1'in altında kalırken, kazananlar artık modeli değil, etrafındaki sistemi tasarlıyor.