DeepSeek çok modlu yapay zeka modeli DeepSeek-V4-Flash-Vision-Exp'i yayımladı
Öne çıkanlar
- DeepSeek-V4-Flash-Vision-Exp, V4 ailesinin ilk çok modlu modeli olarak sunuldu.
- Model, ApexBench çok modlu değerlendirmesinde yüzde 36,5 başarım puanı elde etti.
- Çıkarım tarafında Transformers, vLLM ve SGLang kütüphanelerine doğrudan destek veriliyor.
- Model kodları ve ağırlıkları MIT lisansı altında kullanıma açıldı.
DeepSeek, V4 ailesinin ilk deneysel çok modlu modeli olan DeepSeek-V4-Flash-Vision-Exp sürümünü Hugging Face üzerinden açık kaynak olarak yayımladı. Model, mevcut DeepSeek-V4-Flash mimarisinin üzerine eklenen görsel modüller ve ek eğitim süreçleriyle görsel anlama yetenekleri kazandı.
Yeni model, metin tabanlı görevlerdeki performansını korurken çok modlu ajan testlerinde belirgin kazanımlar sağladı. Paylaşılan test sonuçlarına göre model, ApexBench testinde yüzde 36,5 ve Chartography testinde yüzde 64,3 başarı oranına ulaştı.
MIT lisansıyla dağıtılan model; Transformers, vLLM ve SGLang gibi yaygın çıkarım çatılarıyla doğrudan uyumlu çalışıyor. Depo, PyTorch tabanlı referans çıkarım kodlarını ve istem kodlama araçlarını içeriyor.
Bu özet yapay zekâ ile hazırlanmıştır; ayrıntılar ve doğrulama için orijinal kaynağa başvurun.