« Tüm yayınlar

Agent Control Plane: LLM Önerir, Yetkilendirme Asla Modelde Değil

ACP mimarisi, AI ajanlarında LLM'in önerdiği eylemleri prompt injection'a kapalı bir politika motorunda yetkilendiriyor; kanıtlanabilir ve test edilebilir.

Agent Control Plane (ACP), AI ajanlarına verilen kimlik bilgisini yetkilendirme sanmanın yarattığı riski hedef alan bir mimari: model bir eylem önerir ama karar, prompt injection'ın asla ulaşamayacağı bir politika motorunda verilir. Zehirli bir doküman ya da düşman bir destek talebi modeli ele geçirse bile, risk seviyesi modelin göremediği imzalı politikadan yeniden hesaplanır ve geri döndürülemez işlemler için insan imzası zorunlu kılınır.

Proje iddialarını tek satırlık komutlarla doğrulanabilir kılıyor: Dafny ile biçimsel kanıtlar, 10 test paketinde onlarca saldırı senaryosu ve güvenlik kontrollerinin gerçekten işe yaradığını gösteren mutasyon testleri. Docker Compose üzerinden HTTP API olarak sunulan kapı, kayıtlı olmayan eylem tiplerini, şema dışı parametreleri ve yetki listesi dışındaki hedefleri modele hiç danışmadan reddediyor.

Mühendisler için önemi açık: ajan mimarilerinde yetkilendirmeyi modelin kendisine bırakmak, saldırı yüzeyini modelin okuduğu her metne genişletiyor. ACP, karar noktasını mimari olarak modelin dışına taşıyarak bu sınıf açığı kapatmayı hedefliyor ve iddialarını MITRE ATLAS, ATT&CK ile OWASP LLM Top 10 çerçevelerine haritalıyor.