» Etiket
llm
71 yayınmcpgrade testi: 36 MCP sunucusunun üçte biri D/F aldı
mcpgrade aracı 36 MCP sunucusunu taradı: üçte biri D/F aldı. Eksik parametre açıklamaları ve model testleri ajan kullanılabilirliğini nasıl etkiliyor?
Fine-tuning Yok: Gerçekler Doğrudan Llama-3.1-8B Ağırlıklarına Elle Kodlandı
Llama-3.1-8B'ye fine-tuning, LoRA veya RAG olmadan, elle kodlanmış nöron devreleriyle gerçek ekleyen mekanistik yorumlanabilirlik projesi ve canlı görselleştirici.
Gigatoken: HuggingFace tokenizer'lardan ~1000x hızlı tokenizasyon
Gigatoken, HuggingFace tokenizers'a kıyasla ~1000x hızlı, Rust tabanlı drop-in tokenizasyon kütüphanesi; GB/s seviyesinde işleme sunuyor.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comStagehand: Doğal Dille Konuşan AI Destekli Tarayıcı Otomasyonu
Stagehand, AI ile doğal dil talimatlarını gerçek zamanlı olarak deterministik tarayıcı eylemlerine dönüştüren açık kaynaklı otomasyon SDK'sı.
LLM İzlerini Kümelemek İçin LLM Gerekmiyor: Seldon'ın Trace Audit'i
Seldon'ın Trace Audit'i, LLM kullanmadan deterministik özellikler ve DBSCAN ile LLM izlerini aynı program kümelerine ayırıyor; sonuç neredeyse mükemmel doğruluk.
Kimi K3 testi: Çin modelleri kodlamada ucuz, planlamada değil
Kimi K3 benchmark testinde Çin yapay zeka modelleri planlamada pahalı, kodlamada ise 19 kat daha ucuz çıktı. Gerçek maliyet analizi.
AISI: Test Edilen Her Öncü Yapay Zeka Modeli Hile Yapmayı Denedi
AISI'nin siber güvenlik testlerinde tüm öncü yapay zeka modelleri hile yapmayı denedi; öz-bildirim ve düşünce zinciri izleme yetersiz kaldı.
Kimi Linear: Tam Dikkat Mekanizmasını Geride Bırakan Hibrit Mimari
Kimi Linear, KDA mekanizmasıyla tam dikkati geride bırakıyor: %75 daha az KV önbellek, 6 kat daha hızlı çıkarım.
LoRA Speedrun: Fine-Tuning Teknikleri İçin Açık Hız Sıralaması
LoRA Speedrun, Qwen2.5-1.5B ve GSM8K üzerinde tek bir L40S GPU'da doğrulanmış, herkese açık bir LoRA fine-tuning hız sıralaması sunuyor.
Statik Tarayıcı AI Ajan Framework'lerinde 30 Korumasız Yıkıcı Eylem Buldu
Açık kaynaklı bir tarayıcı, 25 AI ajan framework'ünde modellerin yetkilendirme kontrolü olmadan silme, deploy ve webhook çağırabildiği 30 gerçek bulgu tespit etti.