Çoklu Ajan Sistemlerinde Gizli Maliyet: Paralellik Değil, Bağlam Kirliliği
Çoklu alt-ajan oturumunda asıl maliyetin paralellik değil, orkestratörün bağlamına sızan ham transkriptler olduğu ortaya çıktı; bilişsel yerellik kavramı tanıtılıyor.
Bir geliştirici, dört alt-ajanın paralel çalıştığı bir Claude Code oturumunda beklenmedik bir maliyet kaynağı keşfetti: asıl yük dört ajanı aynı anda çalıştırmaktan değil, orkestratörün 'ajanları kontrol et' komutuyla arka plan ajanlarının ham JSONL transkriptlerini bütünüyle ana bağlama çekmesinden kaynaklanıyordu. Bu, tek seferlik bir token maliyeti değil, sonraki her adımı etkileyen kalıcı bir bağlam kirliliğiydi.
Analiz, token tüketimi ile 'çalışan bellek' kalitesi arasındaki farkı netleştiriyor: token bir kez harcanır, ama kirlenmiş bağlam her sonraki kararı vergilendirir. Yazar ayrıca 'bilişsel yerellik' kavramını öne sürüyor — aynı zihinsel modele ihtiyaç duyan görevlerin birlikte tutulması gerektiğini, aksi halde birden fazla ajanın aynı bağlamı sıfırdan yeniden inşa etmek zorunda kaldığını gösteriyor.
Bu gözlemler, ajan tabanlı iş akışları tasarlayan mühendisler için pratik bir ders sunuyor: paralellik kendi başına amaç değil, alt-ajanların gerçek değeri gürültülü ara akıl yürütmeyi ana iş parçacığından uzak tutmasında yatıyor. Yazar bunu ölçülmüş bir gerçek değil, orkestratörün kendi değerlendirmesine dayanan bir hipotez olarak sunuyor.
Bu sentez, kaynağından yapay zeka tarafından üretildi; insan editör ya da elle onay adımı yoktur. Nasıl çalışıyoruz