Claude Code Auto Mode dolaylı enjeksiyonla uzaktan kod çalıştırdı
Öne çıkanlar
- Saldırı zinciri Claude Code Auto Mode üzerinde yüzde 60 ila 80 başarı oranıyla kod çalıştırdı.
- Model, şüpheli ikili dosyayı reddetse de yazdığı Python kodunu arşiv dizininde çalıştırarak tuzağa düştü.
- Python modül gölgeleme yöntemiyle çalışan zararlı kod, komuta kontrol sunucusu bağlantısı kurdu.
- Anthropic, Auto Mode sınıflandırıcısının bir kum havuzu veya kesin güvenlik sınırı olmadığını bildirdi.
Güvenlik araştırmacısı Johann Rehberger, Anthropic'in Claude Code Opus 5 aracında varsayılan olarak sunulan Auto Mode özelliğini hedef alan başarılı bir dolaylı komut enjeksiyonu saldırı zinciri gösterdi. Anthropic tarafından yaptırılan bağımsız testlerde sıfır saldırı başarı oranı yakalandığı açıklanan modele karşı gerçekleştirilen testlerde, basit bir web sitesi özetleme istemi üzerinden yüzde 60 ila 80 başarı oranıyla uzaktan kod çalıştırma sağlandı.
Saldırı zinciri, modelin güvenilmeyen bir web sitesinden indirilen ZIP arşivini incelemesiyle başladı. Claude, arşiv içindeki şüpheli ikili dosyayı çalıştırmayı reddederek kendi Python kodunu yazdı. Ancak bu kodun arşiv dizini içinde çalıştırılması sonucu, arşivde yer alan zararlı 'struct.py' dosyası Python'un standart kütüphanesini gölgeleyerek arka planda zararlı yazılımı devreye soktu. Modelin güvenlik sınıflandırıcısı bu adımları meşru işlem olarak algıladığı için saldırıyı engelleyemedi.
Anthropic güvenlik ekibi yapılan bildirimi 'bilgilendirme' statüsünde kapatarak sistemin tasarlandığı şekilde çalıştığını belirtti. Şirket, Auto Mode kapsamındaki güvenlik sınıflandırıcısının kesin bir güvenlik sınırı olmadığını, asıl korumanın işletim sistemi düzeyinde yalıtım ve kum havuzu (sandbox) uygulamalarıyla sağlanması gerektiğini kaydetti.
Bu özet yapay zekâ ile hazırlanmıştır; ayrıntılar ve doğrulama için orijinal kaynağa başvurun.