Kendi Kendini İnşa Eden Ajan: LangChain4j ile Bir Deney
OpenAI
Bir kod asistanının, LangChain4j dokümantasyonunu kullanarak kendini klonlayan bir ajan oluşturduğu bir deney. Ortaya çıkan sistem hataları düzeltebiliyor ve testleri geçebiliyor, ancak başlangıçta GPT-4o ile başarısız olup GPT-5-mini ile başarılı oluyor. İş akışı tabanlı yaklaşımın, denetçi tabanlı yaklaşımdan üç kat daha hızlı olduğu kanıtlandı.
InfoQ Çin'deki ekip bir meta-deney gerçekleştirdi: bir kod asistanına LangChain4j dokümantasyonunu verdiler ve bu dokümantasyonu kullanarak kod yazabilen, test edebilen ve hata ayıklayabilen bir ajan geliştirmesini istediler. Kod asistanı, denetçi desenine dayalı çoklu ajan sistemi tasarladı: ExplorerAgent, PlannerAgent, ImplementerAgent ve ExecutorAgent olmak üzere dört alt ajandan oluşuyordu. Bu ilk yineleme, profesyonel kod asistanlarının desenini taklit ederek etkileyici bir şekilde çalıştı. Test etmek için, dört hatalı metoda sahip Calculator sınıfındaki hataları düzeltmesini sağladılar. Başlangıçta OpenAI'nin GPT-4o'sunu kullanarak sistem, '100 ardışık araç çağrısı aşıldı' hatasıyla başarısız oldu. GPT-5-mini'ye geçildiğinde sistem tüm hataları başarıyla düzeltti ve 0 başarısızlıkla 11 test çalıştırdı. Ayrıca, planlama ve yürütme için döngülerle beş adımlı bir sıra kullanan ve SummarizerAgent içeren iş akışı tabanlı bir alternatifi de keşfettiler. Bu alternatif de hataları düzeltti, ancak denetçi tabanlı sürümden üç kat daha hızlı çalıştı: altı dakikadan fazla sürmek yerine sadece iki dakika sürdü. Proje, herkese açık bir kod deposunda mevcuttur.
Kaynak: InfoQ 中国 —
orijinal
