Ana içeriğe geç
Yapay Zeka

Qwen 3.8 akıl yürütme başlangıcında GPT-5.5 Pro'yu izliyor

Öne çıkanlar

  • Qwen 3.8, GPT-5.5 Pro akıl yürütme ön dolgusuyla kaynak geri çağırma oranını 20,58 puan artırdı.
  • STEM kategorisindeki sorularda Qwen'in örtüşme artışı 27,55 puan seviyesine ulaştı.
  • DeepSeek V4 Flash ve Inkling modelleri yapılan ön doldurma testinden neredeyse hiç etkilenmedi.
  • Kimi K3 ön doldurmasız durumda bile GPT-5.5 Pro ile yüzde 50,11 oranında temel örtüşme gösterdi.

Yayımlanan teknik deney sonuçlarına göre, açık yapay zeka modelleri arasında yer alan Qwen 3.8, akıl yürütme kanalına GPT-5.5 Pro'nun düşünce sürecinin ilk yüzde 1'lik kısmı eklendiğinde öğretmen modelin yanıtlarını büyük oranda takip etti. Değerlendirme kapsamında hedef modellere standart sorular iletilerek hem ön doldurma yapılmayan hem de GPT-5.5 Pro akıl yürütmesi eklenen yanıtlar üretildi ve öğretmen modelin görünür cevabının hedef modeldeki ilk 100 belirtece yansıması ölçüldü.

Toplam 45 sorudan oluşan test kümesinde 15 fen bilimleri, 15 fen dışı konu ve 15 yapay bulmaca yer aldı. Deneyde Qwen 3.8'in kaynak geri çağırma oranı yüzde 33,92 seviyesinden ön doldurma sonrasında yüzde 54,50 düzeyine yükselerek 20,58 puanlık mutlak bir artış kaydetti. Bu yükseliş fen bilimleri sorularında 27,55 puana kadar ulaştı ve yapay bulmacalarda da 19,72 puanlık bir sıçrama yaşandı.

Diğer test edilen modellerden DeepSeek V4 Flash yalnızca 0,35 puan, Inkling ise 0,85 puan artış sergileyerek neredeyse hiç etkilenmedi. Kimi K3 modeli başlangıçta da yüzde 50,11 gibi yüksek bir örtüşme oranına sahip olmasına rağmen ön doldurma ile sadece 4,31 puanlık bir artış gösterdi. Elde edilen veriler, Qwen modelinin Opus yerine GPT-5.5 Pro veya yakından ilişkili bir modelden veri aktarımıyla eğitilmiş olabileceğini ortaya koyuyor.

Kaynak

Bu özet yapay zekâ ile hazırlanmıştır; ayrıntılar ve doğrulama için orijinal kaynağa başvurun.