Anthropic yapay zeka gelişim hızının yavaşlatılmasını önerdi
Öne çıkanlar
- Anthropic, şirket içine bağımsız üçüncü taraf denetçiler yerleştireceğini tek taraflı olarak açıkladı.
- Dario Amodei, modellerin kendi kendini geliştirmesi nedeniyle gelişim hızının yavaşlatılmasını önerdi.
- Üç aşamalı güvenlik planı şirket içi denetimi, demokratik işbirliğini ve küresel koordinasyonu kapsıyor.
Anthropic kurucularından Dario Amodei, yayımladığı değerlendirme yazısında yapay zeka yeteneklerinin gelişim hızının güvenlik önlemlerinin yetişebilmesi amacıyla kademeli olarak yavaşlatılması gerektiğini açıkladı. Gelişmiş modellerin kendi kendilerini eğiterek iyileştirme sürecine girmesinin ve otonom sistemlerde görülen siber güvenlik açıklarının kontrol risklerini artırdığını belirten Amodei, sektörün bu tehlikelere karşı dengeli bir tempo yakalaması gerektiğini bildirdi.
Önerilen üç aşamalı yol haritasının ilk adımı olarak Anthropic, şirket içine bağımsız denetçilerin yerleştirilmesini tek taraflı olarak taahhüt etti. Bankacılık sektöründeki denetim mekanizmalarına benzer bu modelde, METR gibi üçüncü taraf kuruluşlardan uzmanlar şirket ofislerinde fiziksel olarak çalışacak, iç araçlara ve eğitim hatlarına doğrudan erişim sağlayacak. Denetçiler, şirketin güvenlik uygulamalarına uyumunu ve iç krizleri kamuoyuna sansürsüz şekilde raporlama yetkisine sahip olacak.
Planın diğer aşamalarında ise demokratik ülkelerdeki şirketlerin ortak güvenlik standartları belirlemesi ve nihayetinde Çin dahil olmak üzere küresel aktörlerle koordinasyon kurulması hedefleniyor. Amodei, bu yavaşlamanın bir duraklama anlamına gelmediğini, elde edilecek ek zamanın operasyonel mükemmeliyet, model yorumlanabilirliği ve hizalama testlerini geliştirmek için kullanılacağını aktardı.
Bu özet yapay zekâ ile hazırlanmıştır; ayrıntılar ve doğrulama için orijinal kaynağa başvurun.