Ana içeriğe geç
Yapay Zeka

Otonom yapay zeka döngüleri için test ve süreç mimarisi önerildi

Öne çıkanlar

  • Geliştirici ajan ile ürünü test eden sürücü katmanı birbirinden tamamen ayrı tutuluyor.
  • Her turda sadece tek bir nedensel yetenek açığı baştan uca ele alınıyor.
  • Ajanın kendi puanlama kurallarını gevşetmesini engelleyen üç kademeli bir yetki modeli kullanılıyor.
  • Tüm süreç ve karar kayıtları depo içindeki metin dosyaları aracılığıyla oturumlar arasında aktarılıyor.

Yazılım geliştirmede kullanılan yapay zeka ajanlarının yalnızca mevcut testleri geçmeye odaklanması, henüz tanımlanmamış ürün yeteneklerini inşa ederken yetersiz kalıyor. Paylaşılan yeni metodoloji, ajanın yalnızca kod tabanındaki testleri geçmesini değil, gerçek kullanıcı etkileşimlerini simüle eden bağımsız bir test düzeneğiyle (harness) yönlendirilmesini öngörüyor. Geliştirme süreci, kod üreten ajan ile ürünü dışarıdan deneyimleyen sürücü katmanını birbirinden ayırıyor.

Söz konusu mimaride her geliştirme turu, tek bir nedensel eksikliği kapatmayı hedefliyor. Sistem, deterministik bir taban doğrulama mekanizması kurarak mevcut kazanımları koruyor ve yeni yeteneklerin eklenmesi sırasında gerilemeleri önlüyor. Ajanın kendi başarı kriterlerini ve test kurallarını tek taraflı değiştirmesini engellemek amacıyla yetki sınırları tanımlanıyor; dondurulmuş dosyalar yalnızca insan müdahalesiyle güncelleniyor.

Sürecin sürekliliği ve denetlenebilirliği, doğrudan Git deposu üzerindeki durum ve hedef dosyalarıyla sağlanıyor. Kararlar, planlar ve çalışma kanıtları metin tabanlı belgelerde saklandığı için model oturumları sıfırlansa dahi bağlam kaybı yaşanmıyor. Nihai yönlendirme ve turun yeterliliği ise insan denetiminde kalmaya devam ediyor.

Kaynak

Bu özet yapay zekâ ile hazırlanmıştır; ayrıntılar ve doğrulama için orijinal kaynağa başvurun.