» Etiket
llm
535 yayınNVIDIA Nemotron 3 Super, Kodlamada GPT-OSS-120B'yi Geride Bıraktı
NVIDIA'nın açık modeli Nemotron 3 Super, SWE-Bench'te GPT-OSS-120B'yi 20 puan geçti ve 2,2x daha hızlı çıkarım sunuyor.
LinkedIn için açık kaynak AI beceri seti: linkedin-skills
LinkedIn paylaşım sürecini sekiz göreve bölüp Claude Code/Codex için açık kaynak on beceri haline getiren linkedin-skills projesinin teknik analizi.
10 AI Kodlama Modeli, 5 Görev: Fiyat Performans Kalitesi Belirlemiyor
10 LLM'in 5 kodlama görevindeki performansı karşılaştırıldı: fiyat-kalite korelasyonu zayıf, ucuz modeller premium'a rakip çıktı.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.com"Halüsinasyon" Tek Bir Hata Değil, Üç Farklı Hata
Halüsinasyon üç ayrı sorun: düzeltilebilir bağlam eksikliği, doğrulanamaz akıcılık ve ulaşılamaz gelecek bilgisi. Mühendisler için ayrım rehberi.
AI Model Fiyatlarındaki Gizli Maliyet: Tokenizer Farkı Faturayı Nasıl Şişiriyor
AI model fiyat kartları $/token gösterir ama tokenizer farkları TypeScript'te faturayı %73'e kadar şişirebilir. Gerçek maliyet analizi.
AEGIS Açık Kaynak Oldu: Kendi Sunucunda Çalışan Kişisel AI Orkestrasyon Platformu
AEGIS, FastAPI, Postgres ve Temporal ile kurulmuş, MIT lisanslı, kendi sunucunda çalışan kişisel AI orkestrasyon platformu olarak açık kaynak yayınlandı.
VetoBench: Ajan Belleği Reddedilen Kararları Hatırlıyor mu?
VetoBench, ajan bellek sistemlerinin reddedilen kararları (vetoları) hatırlayıp hatırlamadığını test eden açık kaynaklı bir kıyaslama.
Claude Code, Prompt'u Okumadan Önce 33 Bin Token Harcıyor
Wire-level analiz: Claude Code, prompt okunmadan önce ~33K token harcıyor; OpenCode'a göre 4,7 kat fazla, gerçek görevlerde 3,7 kat maliyet farkı.
Hermes Agent: Kalıcı Bellek ve Öz-İyileşen Bir AI Ajan Çerçevesi
Nous Research'ün açık kaynaklı Hermes Agent çerçevesi; kalıcı bellek, yeniden kullanılabilir skill'ler ve çoklu ajan mimarisiyle öz-iyileşen bir AI sistemi sunuyor.
Markdown Bilgi Grafiğini Yapay Zeka Ajan Belleği Olarak Ölçmek
IWE, LOCOMO benchmarkıyla markdown bilgi grafiklerini yapay zeka ajan belleği olarak test etti; ucuz bir küratör modeliyle yüzde 96 performansa ulaştı.