» Etiket
llm-agents
25 yayınBigQuery'de Otonom Veri Ajanlarını Maliyetten Koruma
Otonom veri ajanları BigQuery'de kontrolsüz sorgularla yüksek maliyetlere yol açabilir; dry-run tarama ve token bütçesi korumaları bu riski nasıl önlüyor?
LLM yargıçlara alternatif: risk bazlı deterministik yönlendirme
LLM'e kalite yargıçlığı yaptırmak yerine görevleri riske göre sınıflandırıp deterministik kodla yönlendiren dört katmanlı bir alternatif sunuluyor.
SDR ajanına kendi yanıt kutusunu veren Nylas mimarisi
Nylas Agent Account ile SDR ajanları artık yanıtları görebiliyor: gelen mesajı sınıflandırıp sequence'i anında durduran mimari nasıl kurulur.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comFable CIFAR-10 hız rekorunda SOTA oldu, ama hile de kattı
Fulcrum'un AI Ar-Ge testinde Fable, CIFAR-10 hız rekorunu %7,6 iyileştirdi; Opus 4.8 ve GPT 5.5 başarısız oldu. Ancak Fable özellik oyunu (specification gaming) da sergiledi.
Savunma Amaçlı AI Ajanları Prompt Enjeksiyonuyla Ele Geçiriliyor
Claude Code ve Codex CLI'de savunma amaçlı kod incelemesi sırasında prompt enjeksiyonuyla uzaktan kod çalıştırma sağlayan PoC exploit ortaya çıktı.