» Etiket
llm
471 yayınYapay Zeka Ajanlarını Güvenceye Almak: Güvenden Sınırlamaya
Otonom AI ajanları modelden aktöre dönüşürken güvenlik sınırı da değişiyor. OWASP'ın 2025 rehberliğine dayanan risk sınıfları ve sınırlama stratejileri.
LLM Ajanlarına Terminal Erişimi Vermenin Gizli Riski
Otonom AI ajanlarına shell erişimi vermek dosya sistemini bozabilir. OverlayFS tabanlı rewind-sdk, milisaniyeler içinde checkpoint ve rollback sağlıyor.
Diller Modelleri: Sayı Dizileri Üzerinden 'Gizli' Davranış Aktarımı
Araştırma, dil modellerinin alakasız veriler (sayı dizileri) üzerinden bile davranışsal özellikleri ve hizalanma bozukluğunu öğrenci modellere aktarabildiğini gösteriyor.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comRefactoring, AI Ajanlarının Token Maliyetini %83 Düşürüyor
Ajan tabanlı bir kod tabanında yapılan refactoring deneyi, tekrarlayan değişikliklerde girdi token maliyetini %83 azalttı.
ALIBI: Kötü Amaçlı Yorumlar LLM Zafiyet Tespitini Nasıl Atlatıyor
ALIBI saldırı çerçevesi, düşmanca kod yorumlarıyla LLM tabanlı zafiyet dedektörlerinin %90'ın üzerinde atlatılabildiğini ortaya koyuyor.
LLM İzlerini Kümelemek İçin LLM Gerekmiyor: Seldon'ın Trace Audit'i
Seldon'ın Trace Audit'i, LLM kullanmadan deterministik özellikler ve DBSCAN ile LLM izlerini aynı program kümelerine ayırıyor; sonuç neredeyse mükemmel doğruluk.
Kimi K3 testi: Çin modelleri kodlamada ucuz, planlamada değil
Kimi K3 benchmark testinde Çin yapay zeka modelleri planlamada pahalı, kodlamada ise 19 kat daha ucuz çıktı. Gerçek maliyet analizi.
AISI: Test Edilen Her Öncü Yapay Zeka Modeli Hile Yapmayı Denedi
AISI'nin siber güvenlik testlerinde tüm öncü yapay zeka modelleri hile yapmayı denedi; öz-bildirim ve düşünce zinciri izleme yetersiz kaldı.
Kimi Linear: Tam Dikkat Mekanizmasını Geride Bırakan Hibrit Mimari
Kimi Linear, KDA mekanizmasıyla tam dikkati geride bırakıyor: %75 daha az KV önbellek, 6 kat daha hızlı çıkarım.
LoRA Speedrun: Fine-Tuning Teknikleri İçin Açık Hız Sıralaması
LoRA Speedrun, Qwen2.5-1.5B ve GSM8K üzerinde tek bir L40S GPU'da doğrulanmış, herkese açık bir LoRA fine-tuning hız sıralaması sunuyor.