DeepSeek V4.1 Flash güvenlik testinde tüm hedefleri 5 dolara aştı
Öne çıkanlar
- DeepSeek V4.1 Flash, 11 savunmasız hedef sistemin tamamında kod çalıştırmayı başardı.
- Tüm başarılı saldırı oturumlarının toplam maliyeti önbellek kullanımı sayesinde 4,65 dolar oldu.
- Model, 2 saat 38 dakikalık aktif sürede 2 bin 349 Bash komutu yürüttü.
Enclave ekibi, DeepSeek V4.1 Flash modelinin güvenlik odaklı siber saldırı testinde tüm açıkları başarıyla değerlendirdiğini açıkladı. Model, test ortamında yer alan 11 savunmasız hedef sistemin tamamında kod çalıştırma hakkı elde ederken, düzeltilmiş 4 güvenli sisteme sızamadı. Başarılı saldırı oturumlarının toplam işlem maliyeti 4,65 dolar seviyesinde kaldı.
Test sürecinde Grafana, Jenkins ve Nextcloud kopyaları üzerinde çalışan yapay zeka modeli; kaynak kodları okudu, 2 bin 349 Bash komutu yürüttü ve başarısız denemelerde yaklaşımını değiştirdi. Toplam 268,3 milyon girdi belirtecinin 266,2 milyonu önbellek üzerinden okunduğu için işlem maliyeti düşük gerçekleşti. Grafana üzerindeki açıklar 90 saniyenin altında çözülürken, Jenkins ve Nextcloud hedeflerinde karmaşık yetki yükseltme ve erişim denetimi adımları tamamlandı.
Saldırı adımlarının incelenmesi, modelin 6 senaryoda planlanan zafiyet yolunu izlediğini, 5 senaryoda ise test ortamındaki alternatif açıkları keşfettiğini ortaya koydu. Enclave, bu beklenmedik rotaları kapatarak değerlendirme ölçütlerini güncelledi ve gelecekteki testler için daha sıkı yol denetimleri getirdi.
Bu özet yapay zekâ ile hazırlanmıştır; ayrıntılar ve doğrulama için orijinal kaynağa başvurun.