Öğrenciler deneme yazımında Gemini modelini tercih etti
Öne çıkanlar
- StudyArena'nın kör testinde Gemini yüzde 39,6 oy alarak Claude ve ChatGPT'yi geride bıraktı.
- Öğrenciler alternatiflerine kıyasla ortalama yüzde 37 daha uzun yanıtları tercih etti.
- Yüksek akıl yürütme ayarları gereksiz tekrara yol açarak metin kalitesi puanlarını düşürdü.
- Taslak planlamada Claude yüzde 43,2, araştırmada ise ChatGPT yüzde 39,3 oranla öne çıktı.
Eğitim platformu StudyArena tarafından yürütülen kör test sonuçlarına göre üniversite öğrencileri, deneme ve makale yazımı görevlerinde Google'ın Gemini modelini ChatGPT ve Claude'a kıyasla daha başarılı buldu. Ağustos 2026 dönemine ait 6 bin 851 doğrulanmış öğrenci oyunun incelendiği çalışmada, model isimleri gizlenerek yapılan değerlendirmelerde Gemini yüzde 39,6 tercih oranına ulaştı. Anthropic tarafından geliştirilen Claude modelleri yüzde 31,8 oy alırken OpenAI'ın ChatGPT modelleri yüzde 29,2'de kaldı.
Araştırma verileri, öğrencilerin daha uzun ve dengeli yanıtları seçme eğiliminde olduğunu ortaya koydu. Tercih edilen metinler alternatiflerine kıyasla ortalama yüzde 37 daha uzun olurken, yapay zeka modellerindeki yüksek mantıksal akıl yürütme ayarlarının metin kalitesini olumsuz etkilediği görüldü. Düşük çaba ve akıl yürütme seviyesindeki modeller yüzde 40,7 oranında tercih edilirken, en yüksek ayardaki yanıtlar yüzde 29,5 oranında kaldı. Analizde, aşırı akıl yürütmenin metinde gereksiz tekrarlara ve akıcılık kaybına yol açtığı belirtildi.
Farklı yazım aşamalarında ise modellerin öne çıkan yetenekleri değişkenlik gösterdi. Gemini yüzde 41,7 ile metin geri bildirimi ve tashih aşamasında ilk sırayı alırken, Claude yüzde 43,2 ile ödev planlama ve taslak oluşturmada, ChatGPT ise yüzde 39,3 ile araştırma ve argüman haritalama aşamasında liderliği elde etti. Uzmanlar, yapay zekanın doğrudan metin yazdırmak yerine taslakları inceleyen bir editör gibi kullanılmasını önerdi.
Bu özet yapay zekâ ile hazırlanmıştır; ayrıntılar ve doğrulama için orijinal kaynağa başvurun.