DeepSeek yeni asimetrik mimariye sahip 4.1 Flash modelini duyurdu
Öne çıkanlar
- Model, 552 milyar parametreli MoE yapısında girdi için 8 milyar, çıktı için 16 milyar aktif parametre kullanıyor.
- KV önbellek ihtiyacı önceki nesle göre HBM tarafında dörtte bire, SSD tarafında sekizde bire indi.
- Tüm deepseek-v4-pro istekleri 14 Eylül 2026 itibarıyla daha ucuz olan V4.1-Flash modeline yönlendiriliyor.
DeepSeek, yerel görsel anlama yeteneğine sahip yeni mimari ailesinin en küçük modeli olan DeepSeek 4.1 Flash'ı tanıttı. Toplam 552 milyar parametreli bir uzmanlar karması (MoE) yapısına sahip olan model, yeni Nedensel Kodlayıcı-Kod Çözücü mimarisi sayesinde girdi aşamasında 8 milyar, çıktı aşamasında ise 16 milyar aktif parametre çalıştırıyor. Şirket, yeni ön eğitim yöntemleri ve geniş ölçekli pekiştirmeli öğrenme süreçlerinin modeli DeepSeek-V4-Pro dahil önceki amiral gemisi sürümlerin önüne taşıdığını açıkladı.
Model, önceki nesle kıyasla anahtar-değer (KV) önbellek gereksinimlerinde önemli tasarruf sağlıyor. Yeni sistem HBM bellekte dörtte bir, SSD depolamada ise sekizde bir oranında alana ihtiyaç duyuyor. Şirket, yapay zeka etmeni maliyetlerinde büyük pay tutan önbellek kullanımının bu sıkıştırma yöntemiyle belirgin biçimde düştüğünü belirtti. API üzerinde kullanıma açılan model, yerel çok modlu destekle birlikte deepseek-flash adıyla hizmete girdi.
DeepSeek, eski V4-Flash ve V4-Flash-Vision-Exp sürümlerini kullanımdan kaldırdı ve bu modellere gelen istekleri geçici olarak V4.1-Flash'a yönlendirdi. Testlerde V4-Pro modelini performans ve hız açısından geride bırakan 4.1 Flash, 14 Eylül 2026 itibarıyla V4-Pro isteklerini de kendi tarifesi üzerinden karşılamaya başlayacak. Şirket ayrıca yoğun olmayan saatlerde yüzde 50 indirim sağlayan yeni fiyat politikasının 10 Eylül 2026 tarihinde yürürlüğe girdiğini duyurdu.
Bu özet yapay zekâ ile hazırlanmıştır; ayrıntılar ve doğrulama için orijinal kaynağa başvurun.