Ana içeriğe geç
Yapay Zeka

Geliştirici yapay zekanın sınırlarını absürt istemlerle test etti

Öne çıkanlar

  • Claude modeli PySide6 ile görev uygulaması üretmesi için absürt tasarım ve üslup istemleriyle test edildi.
  • Model uydurma teorik metinleri yazabilmesine rağmen kod çıktılarında standart karanlık mod panelleri üretti.
  • İstemlerdeki edebi ve tehditkar tonlamalar arayüz tasarımına ve işlevlere yansımadı.

Yazılım geliştiricisi Charles Leifer, büyük dil modellerinin kodlama ve bağlam anlama yeteneklerini ölçmek amacıyla Claude modelini aşırı karmaşık ve absürt istemlerle sınadı. Deney kapsamında PySide6 kullanılarak Python tabanlı görev listesi uygulamaları geliştirilmesi hedeflendi. İstemlerde hayali şirket içi kavgalar, arayüzü bozan dijital yaratıklar ve mafya tarzı tehditkar üsluplar kullanıldı.

Leifer, modelin teorik tasarım kurallarını kod mimarisine aktarma becerisini ölçmek için uydurma alt kültür akımları ve felsefi metinler talep etti. Yapay zekanın ürettiği metinlerde sıkça kalıp ifadeler kullandığını belirten geliştirici, görsel çıktılarda ise modelin yönlendirmeleri göz ardı ederek standart ve karanlık modlu tipik arayüz şablonlarına yöneldiğini aktardı.

Deneyler sırasında yüzlerce dolarlık jeton harcaması yapıldığını belirten Leifer, modelin edebi tonlamaları ve örtük tasarım direktiflerini anlamada yetersiz kaldığını kaydetti. Çalışma, büyük dil modellerinin karmaşık istemlerdeki bağlamsal incelikler yerine eğitildikleri popüler kod kalıplarına sığındığını gösterdi.

Kaynak

Bu özet yapay zekâ ile hazırlanmıştır; ayrıntılar ve doğrulama için orijinal kaynağa başvurun.