» Etiket
llm
473 yayınBağlam Mühendisliğinin Ötesi: LLM'ler İçin Kanal Disiplini
LLM güvenilirliği için context engineering yetmiyor: kanal mühendisliği ve Socium modeli, insan-AI iletişimini disiplinli tasarlamayı öneriyor.
600 Mimari: LLM'ler Sistem Tasarlarken Neyi Varsayılan Seçiyor?
Altı LLM ailesine 20 mimari brifi verilerek 600 tasarım toplandı; sonuçlar modellerin varsayılan teknoloji tercihlerini ve tutarsızlıklarını ortaya koyuyor.
AVE: Agentik Yapay Zeka için Davranışsal Güvenlik Açığı Standardı
AVE, agentik yapay zeka sistemlerindeki davranışsal güvenlik açıklarını sınıflandıran yeni standart; AIVSS puanlama ve bawbel-scanner ile CI entegrasyonu.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comTatildeki AI Deneyi Kuantum Mekaniğinde Gerçek Bir Keşfe Dönüştü
Bir güvenlik mühendisi, tatilde Claude AI ile 2008'den kalma açık bir kuantum mekaniği problemini kesin aritmetikle çözdü.
Yeni Ajan Sürüsü: Saniyede 1000 Commit ile Koordinasyon
Yapay zeka ajan sürülerinde planlayıcı-işçi mimarisi, özel versiyon kontrol sistemi ve saniyede 1000 commit ölçeğinde koordinasyon çözümleri incelendi.
Araştırma: Yapay Zeka Filigranları Adli Delil Standardını Karşılamıyor
Yeni araştırma, KGW, Unigram ve SynthID filigranlarının parafrazlama sonrası neredeyse tamamen kaybolduğunu ve Daubert standardını karşılamadığını gösteriyor.
120B parametreli LLM, expert akışıyla Android telefonda çalışıyor
Açık kaynaklı bir Android uygulaması, MoE uzmanlarını flash depodan akıtarak 120B parametreli LLM'i telefon CPU'sunda çalıştırıyor, 30B modeller kullanılabilir hızda.
SDABench: LLM'leri Bilimsel Keşifte Test Eden Yeni Kıstas
SDABench, LLM'leri kod çalıştırma yerine altı bilimsel yetenek üzerinden test eden yeni bir kıstas; sonuçlar ciddi eksiklikleri ortaya koyuyor.
Devrede Yalan Söyleyemeyen Yapay Zeka Öğretmeni
digiwleea'nın yapay zeka devre öğretmeni, netlist doğrulama ve simülasyon geri bildirimiyle her üretilen devrenin doğruluğunu garanti ediyor.
Multi-Agent AI Sistemi Bir Haftasonu 1.847 Dolara Mal Oldu
Multi-agent LLM oyunu bir haftasonu 1.847 dolara mal oldu. Maliyet formülü, kök nedenler ve LLM çağrılarını azaltan optimizasyon teknikleri.