GEPA: Yansıtıcı İstekte Gelişim, Pekiştirme Öğrenimini Geçebilir
GEPA, dil yansımasını kullanarak LLM'lerin öğrenme süreçlerini geliştirir ve pekiştirme öğrenimini geride bırakır.
GEPA, dilin yorumlanabilir doğasını kullanarak LLM'lerin öğrenme süreçlerini geliştirir. Bu optimizasyon aracı, deneme yanılma ile yüksek düzeyde kurallar öğrenmek için doğal dil yansımasını entegre eder. GEPA, altı görevde GRPO'yu ortalama %6 oranında geçerek, %20'ye kadar daha iyi sonuçlar elde eder ve 35 kat daha az deneme ile çalışır.
Bu sentez, kaynağından yapay zeka tarafından üretildi; insan editör ya da elle onay adımı yoktur. Nasıl çalışıyoruz