GPT-6 Astra kodlama testlerinde üst sıralara tırmandı
Öne çıkanlar
- GPT-6 Astra, Coding Agent Index testinde 67 puan alarak Fable 5 ve Claude Opus 5 seviyesine ulaştı.
- Modelin API fiyatları milyon belirteç başına girdi için 10 dolara, çıktı için 50 dolara yükseldi.
- Maksimum efor seviyesinde modelin halüsinasyon oranı yüzde 92'den yüzde 51'e indi.
- Kodlama görevlerinde selefine kıyasla üç kat daha az belirteç harcadı.
Artificial Analysis, GPT-6 Astra modeline yönelik bağımsız kıyaslama sonuçlarını 3 Eylül 2026 tarihinde yayımladı. Model, Coding Agent Index testinde 67 puan alarak Fable 5 ve Claude Opus 5 ile aynı seviyeye ulaştı. Yeni model, GPT-5.6 Sol sürümüne kıyasla girdi ve çıktı belirteçlerinde 2,5 katlık fiyat artışı getirdi. Milyon belirteç başına fiyatlar girdi için 10 dolara, çıktı için 50 dolara çıktı.
Yazılım geliştirme alanında yüksek belirteç verimliliği sağlayan model, GPT-5.6 Sol'a göre üçte bir oranında daha az belirteç kullandı. Bu verimlilik artışı sayesinde görev başına maliyet Claude Fable 5'in yarısının altında kaldı. Intelligence Index tarafında ise model 61 puanda kalarak selefiyle aynı skoru paylaştı. Belirteç tüketimindeki yüzde 10'luk düşüşe karşın taban fiyat artışı nedeniyle Intelligence testinde görev başına maliyet yüzde 75 yükseldi.
Bilgi doğruluğu ve halüsinasyon testlerini ölçen AA-Omniscience kıyaslamasında halüsinasyon oranı yüzde 92'den yüzde 51'e geriledi. Model bu başarıyı genel doğruluk oranını 4 puan artırarak elde etti. Çok haftalı ve binlerce dosyalı projeleri ölçen AA-Briefcase testinde yaklaşık 80 Elo puanı kazanan Astra, ekonomik görevleri ölçen GDPval-AA v2 testinde ise 80 puanlık gerileme kaydetti.
Bu özet yapay zekâ ile hazırlanmıştır; ayrıntılar ve doğrulama için orijinal kaynağa başvurun.