DeepSeek çok modlu yeni modelini geliştiricilere açtı
Öne çıkanlar
- Model, tek bir istekte 600 adede kadar görsel kabul edebiliyor.
- Görseller otomatik ölçeklendirilerek en fazla 384 token harcayacak şekilde işleniyor.
- OpenAI ve Anthropic uyumlu API uç noktaları destekleniyor.
DeepSeek, metin ve görsel verilerini birlikte işleyebilen deepseek-v4-flash-vision-exp adlı yeni çok modlu modelini duyurdu. Geliştiricilere sunulan model; görsel açıklama, ekran görüntülerinden metin okuma ve grafik analizi gibi işlemleri gerçekleştirebiliyor. JPEG, PNG, GIF ve WebP formatlarını destekleyen sistem, dosya uzantısı yerine doğrudan içerik kontrolüyle görsel türünü tanıyor.
Geliştiriciler görselleri API'ye base64 kodlaması, harici bağlantı veya Files API aracılığıyla yükleyebiliyor. Model, görsel işleme öncesinde resimleri otomatik olarak yeniden boyutlandırarak görsel başına en fazla 384 token kullanım sınırı uyguluyor. Sistem hem OpenAI uyumlu Chat Completions ve Responses API uç noktalarıyla hem de Anthropic uyumlu arayüzle entegre çalışabiliyor.
Bu özet yapay zekâ ile hazırlanmıştır; ayrıntılar ve doğrulama için orijinal kaynağa başvurun.