» Etiket
llm
423 yayınNetflix, LLM Sunumunu vLLM ve Triton ile Tamamen İçeride Kuruyor
Netflix'in vLLM, Triton ve OpenAI uyumlu API ile kendi LLM sunum altyapısını nasıl kurduğuna dair mühendislik kararları ve üretim dersleri.
Governed Agent: LLM metni okur, kod ve kurallar karar verir
Governed Agent, LLM'i sınırlı metin çıkarımına hapseden, kararları kod ve tablolarla veren deterministik bir mimariyi ITIL örneğiyle gösteriyor.
Bağlam Mühendisliğinin Ötesi: LLM'ler İçin Kanal Disiplini
LLM güvenilirliği için context engineering yetmiyor: kanal mühendisliği ve Socium modeli, insan-AI iletişimini disiplinli tasarlamayı öneriyor.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.com600 Mimari: LLM'ler Sistem Tasarlarken Neyi Varsayılan Seçiyor?
Altı LLM ailesine 20 mimari brifi verilerek 600 tasarım toplandı; sonuçlar modellerin varsayılan teknoloji tercihlerini ve tutarsızlıklarını ortaya koyuyor.
AVE: Agentik Yapay Zeka için Davranışsal Güvenlik Açığı Standardı
AVE, agentik yapay zeka sistemlerindeki davranışsal güvenlik açıklarını sınıflandıran yeni standart; AIVSS puanlama ve bawbel-scanner ile CI entegrasyonu.
Tatildeki AI Deneyi Kuantum Mekaniğinde Gerçek Bir Keşfe Dönüştü
Bir güvenlik mühendisi, tatilde Claude AI ile 2008'den kalma açık bir kuantum mekaniği problemini kesin aritmetikle çözdü.
Yeni Ajan Sürüsü: Saniyede 1000 Commit ile Koordinasyon
Yapay zeka ajan sürülerinde planlayıcı-işçi mimarisi, özel versiyon kontrol sistemi ve saniyede 1000 commit ölçeğinde koordinasyon çözümleri incelendi.
Araştırma: Yapay Zeka Filigranları Adli Delil Standardını Karşılamıyor
Yeni araştırma, KGW, Unigram ve SynthID filigranlarının parafrazlama sonrası neredeyse tamamen kaybolduğunu ve Daubert standardını karşılamadığını gösteriyor.
120B parametreli LLM, expert akışıyla Android telefonda çalışıyor
Açık kaynaklı bir Android uygulaması, MoE uzmanlarını flash depodan akıtarak 120B parametreli LLM'i telefon CPU'sunda çalıştırıyor, 30B modeller kullanılabilir hızda.
SDABench: LLM'leri Bilimsel Keşifte Test Eden Yeni Kıstas
SDABench, LLM'leri kod çalıştırma yerine altı bilimsel yetenek üzerinden test eden yeni bir kıstas; sonuçlar ciddi eksiklikleri ortaya koyuyor.