xAI kodlama ve bilgi işleme odaklı Grok 4.7 modelini sundu
Öne çıkanlar
- Grok 4.7, milyon girdi tokenı başına 2 dolar ve çıktı tokenı başına 6 dolar fiyat etiketiyle yayımlandı.
- CursorBench 4.0 yazılım mühendisliği kıyaslamasında yüzde 46,3 başarı skoruna ulaştı.
- HackerBench testinde kötü amaçlı komutların sadece yüzde 3,3'üne izin vererek güvenlik direncini artırdı.
xAI, kodlama ve profesyonel bilgi işleme görevleri için geliştirdiği yeni büyük dil modeli Grok 4.7'yi tanıttı. Önceki sürüm Grok 4.6 ile aynı fiyat seviyesini koruyan model, bir milyon girdi tokenı başına 2 dolar ve çıktı tokenı başına 6 dolar maliyetle sunuldu. Şirket, yeni modelin CursorBench 4.0 ve DeepSWE v1.1 gibi uzun soluklu yazılım mühendisliği testlerinde sınıfının en güçlü fiyat-performans dengesini sağladığını bildirdi.
Grok 4.7, daha büyük bir temel model mimarisi üzerine inşa edildi ve tamamlanması saatler süren karmaşık görevleri içeren kapsamlı bir pekiştirmeli öğrenme sürecinden geçti. Kendi çıktılarını doğrulama kabiliyeti artırılan model, ofis belgeleri hazırlama, hukuki analiz ve klinik akıl yürütme alanlarındaki testlerde de belirgin performans artışı sergiledi. Elektrik mühendisliği odaklı EEBench testinde yüzde 64 başarı oranına ulaşarak önceki sürümün yüzde 53'lük skorunu aştı.
Güvenlik tarafında tamamen yenilenen bir koruma katmanı kullanan model, siber güvenlik ve biyolojik riskler gibi alanlardaki jailbreak girişimlerine karşı şimdiye kadarki en yüksek direnci sağladı. Modelin riskli siber görevlerin yer aldığı HackerBench v0.3 testinde tehlikeli isteklerin yalnızca yüzde 3,3'üne yanıt verdiği açıklandı. Grok 4.7, Cursor, Grok Build platformları ve doğrudan API üzerinden genel erişime açıldı.
Bu özet yapay zekâ ile hazırlanmıştır; ayrıntılar ve doğrulama için orijinal kaynağa başvurun.