» Etiket
llm
423 yayınHermes Agent: Kalıcı Bellek ve Öz-İyileşen Bir AI Ajan Çerçevesi
Nous Research'ün açık kaynaklı Hermes Agent çerçevesi; kalıcı bellek, yeniden kullanılabilir skill'ler ve çoklu ajan mimarisiyle öz-iyileşen bir AI sistemi sunuyor.
Markdown Bilgi Grafiğini Yapay Zeka Ajan Belleği Olarak Ölçmek
IWE, LOCOMO benchmarkıyla markdown bilgi grafiklerini yapay zeka ajan belleği olarak test etti; ucuz bir küratör modeliyle yüzde 96 performansa ulaştı.
Uçtan Uca Bir RAG Mimarisi: Tek Self-Hosted Yığında Tüm Kavramlar
Self-hosted RAG mimarisinin tüm parçaları: Docling parsing, hibrit arama, RRF, bilgi grafiği, token bütçeleme ve paralellik — gerçek kodla.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comTek Prompt Yerine Orkestrasyon: Marka Platformu Mimarisinden Dersler
BrandBrahma ekibi, tek bir LLM çağrısı yerine dört orkestratörlü agent mimarisini neden seçtiğini anlatıyor: doğrulama ve üretim görevlerini ayırmanın mühendislik mantığı.
MiniMax M2.7: Kendi Eğitimini Optimize Eden Açık Kaynak AI
MiniMax'ın açık kaynaklı M2.7 modeli, eğitim sürecine bellek yazma ve beceri geliştirme yetkisiyle katılarak %30 verimlilik artışı sağladı; SWE-bench Pro'da GPT-5.3-Codex'i yakaladı.
Yapay zekayla kendi yapay zekasını sızma testine tabi tutmak
Bir mühendis, sızma testi yapan LLM ajanının her bulguyu kanıtlamasını zorunlu kılan bir sistem kurdu; belirsiz 'olabilir' raporları yerine deterministik oracle'larla doğrulanmış exploit'ler üretiyor.
Kapalı Claude Yerine Açık Qwen'e Canlı Düşünce İzleyici
Anthropic'in workspace makalesi ilham verdi; bir geliştirici Claude yerine açık Qwen modeli için canlı, token bazlı bir iç düşünce izleyici geliştirdi.
Yapay Zekalar Anlaşamayınca: Qwen-Max ile Çok Ajanlı Kod İncelemesi
ShiftLeft Society, iki yapay zeka incelemecinin bütçe maliyetiyle müzakere ettiği bir sistem kurdu; Qwen-Max tabanlı bu tribünal doğruluğu %82,5'ten %95'e çıkardı.
Ajanlı Yapay Zeka Ekonomisi: Sınırsız Otonomi Neden Pahalıya Patlıyor
Ajanlı yapay zeka projeleri, katı iş süreçlerini açık uçlu akıl yürütme görevleri gibi ele alarak hem bütçeyi hem güvenliği tehlikeye atıyor.
2.8 Trilyon Parametreli Kimi K3, GPU'suz Mini PC'de Çalıştırıldı
Moonshot'un 2.8T parametreli açık ağırlıklı Kimi K3 modeli, disk üzerinden uzman akışı ile GPU'suz mini PC'de çalıştırıldı.