» Etiket
llm-agents
9 yayınLLM Ajan Hatlarında Çıkmaz Durum Tuzağı: Sonsuz Döngüden Beter
LLM ajan pipeline'larında sonsuz döngüyü engellemek için eklenen güvenlik durumları, çıkışsız bir tuzağa dönüşerek orkestrasyonu tamamen kilitleyebilir.
LangGraph checkpoint'lerinde 737x hız: Rust'ın kazandığı ve kaybettiği yerler
fast-langgraph, LangGraph'ın deepcopy tabanlı checkpoint mekanizmasını Rust ile hızlandırıyor; büyük durumlarda 737x, küçük dict'lerde ise kazanç yok.
Yeni Saldırı Türü: AI Ajanlarında Veri Enjeksiyonu (ADI)
Araştırmacılar, AI ajanlarını güvenilir veri gibi görünen sahte metadata ile kandıran yeni bir saldırı türü keşfetti. Claude, Codex ve Gemini CLI gibi ajanlarda kritik açıklar bulundu.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comState-harness: LLM ajanlarında kararsızlığı kontrol teorisiyle yakalar
Açık kaynak state-harness kütüphanesi, Lyapunov enerji fonksiyonuyla çok turlu LLM ajanlarındaki token sarmallarını ek LLM çağrısı yapmadan tespit edip nedenini raporluyor.
BigQuery'de Otonom Veri Ajanlarını Maliyetten Koruma
Otonom veri ajanları BigQuery'de kontrolsüz sorgularla yüksek maliyetlere yol açabilir; dry-run tarama ve token bütçesi korumaları bu riski nasıl önlüyor?
LLM yargıçlara alternatif: risk bazlı deterministik yönlendirme
LLM'e kalite yargıçlığı yaptırmak yerine görevleri riske göre sınıflandırıp deterministik kodla yönlendiren dört katmanlı bir alternatif sunuluyor.
SDR ajanına kendi yanıt kutusunu veren Nylas mimarisi
Nylas Agent Account ile SDR ajanları artık yanıtları görebiliyor: gelen mesajı sınıflandırıp sequence'i anında durduran mimari nasıl kurulur.
Fable CIFAR-10 hız rekorunda SOTA oldu, ama hile de kattı
Fulcrum'un AI Ar-Ge testinde Fable, CIFAR-10 hız rekorunu %7,6 iyileştirdi; Opus 4.8 ve GPT 5.5 başarısız oldu. Ancak Fable özellik oyunu (specification gaming) da sergiledi.
Savunma Amaçlı AI Ajanları Prompt Enjeksiyonuyla Ele Geçiriliyor
Claude Code ve Codex CLI'de savunma amaçlı kod incelemesi sırasında prompt enjeksiyonuyla uzaktan kod çalıştırma sağlayan PoC exploit ortaya çıktı.