» Etiket
agentic-ai
35 yayınAjan Tabanlı Yapay Zekada ROI: Token Değil, Sonuç Maliyeti Ölçün
Ajan tabanlı yapay zeka yatırımlarında ROI'yi token yerine kabul edilen sonuç başına maliyetle ölçmek için beş adımlı bir çerçeve.
MCP'de Confused Deputy Sorunu: Kaynak Doğrulama Boşluğu ve DNS Rebinding
MCP protokolündeki confused deputy açığı: kaynak doğrulama eksikliği, prompt injection ve DNS rebinding saldırıları ile tespit kuralları.
LingBot-World 2.0: Ant Group'un açık nedensel dünya modeli
Ant Group, 14B parametreli LingBot-World-Infinity ile MoBA dikkat mekanizması ve ajan yapısıyla 60 dakika kesintisiz dünya simülasyonu sunuyor.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comYapay Zeka Ajanlarını Güvenceye Almak: Güvenden Sınırlamaya
Otonom AI ajanları modelden aktöre dönüşürken güvenlik sınırı da değişiyor. OWASP'ın 2025 rehberliğine dayanan risk sınıfları ve sınırlama stratejileri.
Anthropic, yapay zeka odaklı yazılım geliştirme sürecini nasıl güvenli hale getiriyor
Anthropic'in Claude tabanlı geliştirme sürecinde güvenliği kod, test ve dağıtım aşamalarına nasıl entegre ettiğini inceliyoruz.
GPT-5.6 mi, Claude Fable 5 mi: Fiziksel AI simülasyon testi
JuliaHub'ın Dyad ajanıyla GPT-5.6 ve Claude Fable 5, beş fiziksel modelleme probleminde karşılaştırıldı; maliyet, hız ve doğrulama tarzları analiz edildi.
MCP Güvenliğinde Ölçme Devrimi: %9'dan %63'e Çıkan Proxy
Açık kaynak mcp-defense-bench kıyaslaması, MCP güvenlik proxy'si mcp-bastion'ın kapsamını %9'dan %63'e nasıl çıkardığını gösteriyor.
Yapay zekayla kendi yapay zekasını sızma testine tabi tutmak
Bir mühendis, sızma testi yapan LLM ajanının her bulguyu kanıtlamasını zorunlu kılan bir sistem kurdu; belirsiz 'olabilir' raporları yerine deterministik oracle'larla doğrulanmış exploit'ler üretiyor.
Ajanlı Yapay Zeka Ekonomisi: Sınırsız Otonomi Neden Pahalıya Patlıyor
Ajanlı yapay zeka projeleri, katı iş süreçlerini açık uçlu akıl yürütme görevleri gibi ele alarak hem bütçeyi hem güvenliği tehlikeye atıyor.
Kodlama Ajanlarını Model Değil, Harness Tasarımı İyileştiriyor
LangChain bir kodlama ajanını modeli değiştirmeden Terminal-Bench'te ilk 5'e taşıdı; kazanç tamamen harness tasarımından geldi.