» Etiket
ai
1019 yayınGPT-5.6 mi, Claude Fable 5 mi: Fiziksel AI simülasyon testi
JuliaHub'ın Dyad ajanıyla GPT-5.6 ve Claude Fable 5, beş fiziksel modelleme probleminde karşılaştırıldı; maliyet, hız ve doğrulama tarzları analiz edildi.
Fable 5 vs GPT-5.6 Sol: NP-Zor Problemde /goal İşe Yarıyor mu?
Claude Fable 5 ve GPT-5.6 Sol, NP-zor bir fiber ağ optimizasyon probleminde /goal özelliğiyle test edildi; sonuçlar beklenmedik çıktı.
NVIDIA Nemotron 3 Super, Kodlamada GPT-OSS-120B'yi Geride Bıraktı
NVIDIA'nın açık modeli Nemotron 3 Super, SWE-Bench'te GPT-OSS-120B'yi 20 puan geçti ve 2,2x daha hızlı çıkarım sunuyor.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comSteam'de Üç Yıllık Yapay Zeka Analizi: 53.600 Oyun Sayımı
53.600 Steam oyunluk sayım, yapay zeka bildirimlerinin 2024-2026'da yayılışını ve ticari başarı oranlarını ortaya koyuyor.
LinkedIn için açık kaynak AI beceri seti: linkedin-skills
LinkedIn paylaşım sürecini sekiz göreve bölüp Claude Code/Codex için açık kaynak on beceri haline getiren linkedin-skills projesinin teknik analizi.
Engrava: Yapay Zeka Ajanları İçin SQLite Tabanlı Deterministik Bellek Kütüphanesi
Engrava, ajan belleğini SQLite'ta tipli graf olarak saklayan, LLM yeniden yazımı yerine deterministik konsolidasyon kullanan MIT lisanslı Python kütüphanesi.
"Halüsinasyon" Tek Bir Hata Değil, Üç Farklı Hata
Halüsinasyon üç ayrı sorun: düzeltilebilir bağlam eksikliği, doğrulanamaz akıcılık ve ulaşılamaz gelecek bilgisi. Mühendisler için ayrım rehberi.
AI Model Fiyatlarındaki Gizli Maliyet: Tokenizer Farkı Faturayı Nasıl Şişiriyor
AI model fiyat kartları $/token gösterir ama tokenizer farkları TypeScript'te faturayı %73'e kadar şişirebilir. Gerçek maliyet analizi.
AEGIS Açık Kaynak Oldu: Kendi Sunucunda Çalışan Kişisel AI Orkestrasyon Platformu
AEGIS, FastAPI, Postgres ve Temporal ile kurulmuş, MIT lisanslı, kendi sunucunda çalışan kişisel AI orkestrasyon platformu olarak açık kaynak yayınlandı.
VetoBench: Ajan Belleği Reddedilen Kararları Hatırlıyor mu?
VetoBench, ajan bellek sistemlerinin reddedilen kararları (vetoları) hatırlayıp hatırlamadığını test eden açık kaynaklı bir kıyaslama.