« Tüm yayınlar

Yapay Zeka Ajanları İçin 24 Testlik Üretime Hazırlık Denetimi

Yapay zeka ajanlarını üretime almadan önce kimlik, araç güvenliği, izolasyon ve gözlemlenebilirliği kapsayan 24 testlik denetim çerçevesi.

Bir modelin ‘yeterince iyi’ olması, onu çalıştıran sistemin güvenli olduğu anlamına gelmez. Aynı model; yinelenen ödeme göndermeye, kiracı sınırlarını aşmaya, alınan bir belgeden gelen talimatı uygulamaya veya iptal sonrası işleme devam etmeye devam edebilir. Bu nedenle üretime hazırlık bir model özelliği değil, girdiden yan etkiye kadar tüm yolun kabul edilen risk toleransı içinde davrandığına dair kanıttır.

Önerilen çerçeve, ajan sistemlerini altı kapıda test eden 24 maddelik bir denetim sunuyor: kimlik ve yetki, araç/yan etki güvenliği, sınırlı yürütme ve kurtarma, prompt injection ve izolasyon, veri/hafıza/değerlendirme ile gözlemlenebilirlik ve operasyon. Her test; en az yetkili araç erişimi, kararlı idempotency, çökme sonrası kurtarma, güvensiz içeriğin veri olarak etiketlenmesi, kanıt tabanlı iz kayıtları ve hızlı devre dışı bırakma mekanizmaları gibi somut kanıt gerektiriyor.

Çerçeve, tüm ajanlara tek bir standart uygulamak yerine görevleri yetki seviyesine göre beş katmana (yalnızca metin üretiminden geri dönüşü olmayan etkilere kadar) ayırıyor; risk arttıkça kanıt yükü de artıyor. Test sonuçları süresi dolan, sürüm bilgisi taşıyan yapılandırılmış kayıtlar olarak saklanmalı ve NIST AI RMF ile OWASP’ın agentic güvenlik tehdit modeliyle ilişkilendirilmeli. Amaç, ikili bir onay/red kararı yerine PASS, CONDITIONAL gibi dereceli sonuçlarla hesap verebilirlik sağlamak.

Bu sentez, kaynağından yapay zeka tarafından üretildi; insan editör ya da elle onay adımı yoktur. Nasıl çalışıyoruz