Araştırmacılar Claude Opus ile OpenAI sistemlerine sızdı
Öne çıkanlar
- Claude Opus 5, libheif kütüphanesindeki bellek hatasını birkaç saat içinde çalışan bir saldırı koduna dönüştürdü.
- Aşırı yetkilendirilmiş SSO belirteçleri araştırmacıların OpenAI çalışan hesabına ve özel GitHub deposuna erişmesine yol açtı.
- Tüm araştırma süreci 3 bin dolardan az yapay zeka belirteci harcamasıyla tamamlandı.
- OpenAI hatayı onaylayarak araştırmacılara 6 bin 500 dolar ödül verdi ve oturum yetkilerini daralttı.
Hacktron AI bünyesindeki üç güvenlik araştırmacısı, Anthropic tarafından yayımlanan Claude Opus 5 modelini kullanarak OpenAI altyapısına yönelik bir siber saldırı zinciri kurguladı. Araştırmacılar, libheif kütüphanesindeki bir bellek taşması açığını çalışan bir uzaktan kod yürütme saldırısına dönüştürmek için yapay zeka modelinden faydalandı. Önceki model sürümü bellek korumalarını aşamazken Opus 5, birkaç saat içinde çalışan bir saldırı kodu üretti.
Saldırı zinciri OpenAI şirketinin Discourse tabanlı kullanıcı forumuna yüklenen zararlı bir HEIC görseliyle başladı. Forum sunucusunda kod çalıştırma yetkisi elde eden ekip, şirketin tekli oturum açma mekanizmasındaki bir yetki hatasını tespit etti. Forum için üretilen oturum belirteçlerinin bağlı ChatGPT ve Codex hesaplarına tam API erişimi sağladığı görüldü. Bir çalışanın Codex hesabı üzerinden OpenAI şirketinin özel GitHub deposuna erişildi ve sembolik bir değişiklik kaydı açıldı.
Araştırmacılar insan müdahalesini devreden çıkararak Claude modelini otonom bir döngüde de test etti ve model tek başına hedef sunucuda kod çalıştırmayı başardı. Tüm süreç yaklaşık iki ay sürdü ve 3 bin dolardan az model jetonu harcandı. OpenAI, Hacktron ekibine 6 bin 500 dolar hata ödülü ödedi, topluluk belirteçlerinin yetkilerini daralttı ve etkilenen tüm aktif oturumları sonlandırdı.
Bu özet yapay zekâ ile hazırlanmıştır; ayrıntılar ve doğrulama için orijinal kaynağa başvurun.