» Etiket
machine-learning
163 yayınBüyük Dil Modellerinde RL ile Akıl Yürütme: Politika Seçimi
Pekiştirme öğrenimi, büyük dil modellerinde akıl yürütmeyi geliştirmekte ancak yeni stratejiler öğretmemektedir.
Açık Modelin Bilim Yapma Yeteneği Geliştirildi
Loka ve Arcee AI işbirliğiyle geliştirilen açık model, bilimsel araştırmalarda araç kullanma ve mantıksal çıkarım yapma yeteneği kazandı.
NVIDIA Alpamayo 2 Super: 34B Açık Görüş-Dil-Eylem Modeli
NVIDIA, Alpamayo 2 Super modelini tanıttı. 34B açık görüş-dil-eylem modeli, robotaksiler için önemli bir adım.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comThinking Machines, Inkling Small ile Açık Kaynak AI Modelini Tanıttı
Thinking Machines, Inkling-Small modelini tanıttı. Daha küçük boyutla yüksek performans sunuyor.
LLM'lerin Kriptanaliz Yeteneğini Ölçme
Yeni benchmark, LLM'lerin kriptanaliz yeteneğini ölçüyor. Anthropic'in modeli yeni saldırılar keşfetti.
PyTorch'ta Profil Oluşturma (Bölüm 3): Dikkat Profilinizdir
PyTorch'ta dikkat mekanizmasını profil oluşturma ile ele alıyoruz. Performans iyileştirmeleri için in-place operasyonlar kullanıyoruz.
Yapay Zeka Tersine Mühendislik Ölçeği
AgentRE-Bench, AI ajanlarının tersine mühendislik yeteneklerini değerlendiriyor. Kalibrasyon, akıl yürütme derinliğinden daha etkili.
Open-ultra: Kendini Eğiten LLM Yönlendirme Proxy'si
Open-ultra, maliyetleri düşürerek yüksek kaliteli çıktı elde etmek için kendini eğiten bir LLM yönlendirme proxy'sidir.
Qwen3.6-35B-A3B ile 4× Intel Arc Pro B70: 200 tok/s Performans
Qwen3.6-35B-A3B, 4 Intel Arc Pro B70 ile optimize edilmiş dört yapılandırma sunuyor. Performans ve esneklik için ideal çözümler.
Kod onarım eğitim verisi oluşturuldu ve değerlendirme paylaşıldı
Yeni kod onarım veri seti, mühendislerin doğruluğu test etmesine olanak tanıyor. Hata düzeltme oranları %17'den %40'a çıkıyor.