» Etiket
llm
28 yayınTek Ajanda 6 MCP Sunucusu: Gerçek Token Faturası Ne Çıktı
Altı MCP sunucusunu tek ajana bağlayan mühendis, token maliyetini, gecikmeyi ve OAuth sorunlarını ölçtü; %53 maliyet düşüşü sağlayan dört değişikliği paylaştı.
Yapay Zeka Görünürlük Skorunuz Sizi Yanıltıyor Olabilir
1.790 sorgulu bir denetim, AI görünürlük skorlarının çoğunun yanıltıcı olduğunu; markalı/markasız karışımı ve tek motor skorlarının neden hatalı olduğunu gösteriyor.
Kendini Geliştiren Ajan Sistemleri İçin Birleşik Bir Çerçeve
Ajan sistemlerinde kendini geliştirmeyi model ağırlıklarının ötesinde ele alan; Skill, Harness ve kendine-referanslı evrimi birleştiren kavramsal bir çerçeve.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comAI Model Fiyatlarındaki Gizli Maliyet: Tokenizer Farkı Faturayı Nasıl Şişiriyor
AI model fiyat kartları $/token gösterir ama tokenizer farkları TypeScript'te faturayı %73'e kadar şişirebilir. Gerçek maliyet analizi.
AEGIS Açık Kaynak Oldu: Kendi Sunucunda Çalışan Kişisel AI Orkestrasyon Platformu
AEGIS, FastAPI, Postgres ve Temporal ile kurulmuş, MIT lisanslı, kendi sunucunda çalışan kişisel AI orkestrasyon platformu olarak açık kaynak yayınlandı.
VetoBench: Ajan Belleği Reddedilen Kararları Hatırlıyor mu?
VetoBench, ajan bellek sistemlerinin reddedilen kararları (vetoları) hatırlayıp hatırlamadığını test eden açık kaynaklı bir kıyaslama.
Claude Code, Prompt'u Okumadan Önce 33 Bin Token Harcıyor
Wire-level analiz: Claude Code, prompt okunmadan önce ~33K token harcıyor; OpenCode'a göre 4,7 kat fazla, gerçek görevlerde 3,7 kat maliyet farkı.
Hermes Agent: Kalıcı Bellek ve Öz-İyileşen Bir AI Ajan Çerçevesi
Nous Research'ün açık kaynaklı Hermes Agent çerçevesi; kalıcı bellek, yeniden kullanılabilir skill'ler ve çoklu ajan mimarisiyle öz-iyileşen bir AI sistemi sunuyor.
Markdown Bilgi Grafiğini Yapay Zeka Ajan Belleği Olarak Ölçmek
IWE, LOCOMO benchmarkıyla markdown bilgi grafiklerini yapay zeka ajan belleği olarak test etti; ucuz bir küratör modeliyle yüzde 96 performansa ulaştı.
TormentNexus AI Beceri Kayıt Defteri 5.776 Modüle Ulaştı
TormentNexus'un 5.776 modüllük AI beceri kayıt defteri; kod inceleme, Terraform üretimi ve veritabanı migrasyonunda zincirlenebilir otomasyon sunuyor.