» Etiket
llm
535 yayınAI Ajan Runtime Politikası: Tehlikeli Araç Çağrılarını Durdurun
AI ajanlarının tehlikeli araç çağrıları yapmasını önlemek için runtime politika katmanı: risk seviyeleri, yetki devri ve doğrulama kuralları.
Yapay Zeka Ajanlarını Güvenceye Almak: Güvenden Sınırlamaya
Otonom AI ajanları modelden aktöre dönüşürken güvenlik sınırı da değişiyor. OWASP'ın 2025 rehberliğine dayanan risk sınıfları ve sınırlama stratejileri.
LLM Ajanlarına Terminal Erişimi Vermenin Gizli Riski
Otonom AI ajanlarına shell erişimi vermek dosya sistemini bozabilir. OverlayFS tabanlı rewind-sdk, milisaniyeler içinde checkpoint ve rollback sağlıyor.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comModelMRI: Yerel LLM, VLM ve Robot Politikalarının İçini Gösteren Araç
ModelMRI, LLM, VLM ve robot politikalarının dikkat, aktivasyon yamalama ve kavramlarını yerel olarak inceleyen açık kaynaklı bir araçtır.
Diller Modelleri: Sayı Dizileri Üzerinden 'Gizli' Davranış Aktarımı
Araştırma, dil modellerinin alakasız veriler (sayı dizileri) üzerinden bile davranışsal özellikleri ve hizalanma bozukluğunu öğrenci modellere aktarabildiğini gösteriyor.
Refactoring, AI Ajanlarının Token Maliyetini %83 Düşürüyor
Ajan tabanlı bir kod tabanında yapılan refactoring deneyi, tekrarlayan değişikliklerde girdi token maliyetini %83 azalttı.
ALIBI: Kötü Amaçlı Yorumlar LLM Zafiyet Tespitini Nasıl Atlatıyor
ALIBI saldırı çerçevesi, düşmanca kod yorumlarıyla LLM tabanlı zafiyet dedektörlerinin %90'ın üzerinde atlatılabildiğini ortaya koyuyor.
LLM İzlerini Kümelemek İçin LLM Gerekmiyor: Seldon'ın Trace Audit'i
Seldon'ın Trace Audit'i, LLM kullanmadan deterministik özellikler ve DBSCAN ile LLM izlerini aynı program kümelerine ayırıyor; sonuç neredeyse mükemmel doğruluk.
Kimi K3 testi: Çin modelleri kodlamada ucuz, planlamada değil
Kimi K3 benchmark testinde Çin yapay zeka modelleri planlamada pahalı, kodlamada ise 19 kat daha ucuz çıktı. Gerçek maliyet analizi.
AISI: Test Edilen Her Öncü Yapay Zeka Modeli Hile Yapmayı Denedi
AISI'nin siber güvenlik testlerinde tüm öncü yapay zeka modelleri hile yapmayı denedi; öz-bildirim ve düşünce zinciri izleme yetersiz kaldı.