» Etiket
llm
155 yayınStartuplar Neden Tek Bir AI Sağlayıcısına Bağlı Kalmamalı
Tek bir AI sağlayıcısına bağımlı kalmak startuplar için maliyetli teknik borç yaratır; OpenAI uyumlu, çoklu sağlayıcı destekleyen API'ler daha esnek ve ucuz bir alternatif sunuyor.
Skill Retriever: Hermes Agent'a 10K kategorili semantik beceri keşfi
Skill Retriever, Hermes Agent için 1.200'den fazla beceriyi 10.000 kategorilik yetenek ağacında sınıflandırıp sorguya en uygun 5 beceriyi otomatik öneriyor.
Yapay Zeka Editör Aracında Asıl Sorun Kural Değil Sıralamaydı
Bir yazarın AI destekli editör asistanında yaşadığı üç ayrı arıza, rubriği genişletmek yerine farklı akıl yürütme görevlerini ayrı aşamalara bölerek çözüldü.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comTemporal ve CrewAI ile Hataya Dayanıklı AI Ajan İş Akışları
Kurumsal AI ajan sistemlerinde durum kalıcılığı, insan onayı ve hata yönetimini Temporal orkestrasyon motoru ile CrewAI ajanlarını birleştirerek nasıl çözersiniz? Referans mimari incelemesi.
Tessera: Kanıtsız Cevap Vermeyen Açık Kaynak AI Ajan Katmanı
Tessera, kurumsal verileri tek bir bilgi grafiğinde birleştirip her iddiayı kaynağa kadar izleyen, kanıtsız cevap vermeyen deterministik bir AI ajan çerçevesi.
LLM Uygulamaları Neden Dağıtık Sistem Gibi Tasarlanmalı
Prod ortamda çöken bir AI uygulamasından çıkan ders: sorun model değil, kuyruk, cache, retry ve gözlemlenebilirlik eksikliğiydi. Backend mühendisliği devreye giriyor.
FTPO ile Akıl Yürütme Modellerinde Sonsuz Döngü Sorunu Çözülüyor
Antidoom yöntemi, FTPO tekniğiyle akıl yürütme modellerindeki tekrarlayan döngü hatasını hedefli biçimde düzeltiyor; LFM2.5 ve Qwen3.5 modellerinde döngü oranı belirgin şekilde düştü.
Qwen3.6-27B'de KV Önbellek Kuantizasyonunun KLD Etkisi
Bartowski'nin Qwen3.6-27B GGUF modelinde Q8, Q6 ve Q5 seviyelerinde KV önbellek kuantizasyonunun KL diverjansına etkisi ölçüldü; (q8_0,q8_0) neredeyse bedava kalite koruyor.
Yeni çalışma: Dil modelleri parametre başına 3.6 bit ezberliyor
Araştırmacılar, dil modellerinin ezberleme kapasitesini ölçen yeni bir yöntem geliştirdi ve GPT tarzı modellerin parametre başına yaklaşık 3.6 bit bilgi depoladığını buldu.
Subtext: LLM'in İç Düşüncelerini Canlı Görselleştiren Araç
Subtext, Anthropic'in Jacobian lens yöntemini kullanarak Qwen3.5-4B modelinin iç temsillerini canlı sohbet sırasında görselleştiren açık kaynak bir araç.