Ana içeriğe geç
Yapay Zeka

GLM-5.3 modelinin sansürsüz sürümü yayımlandı

Öne çıkanlar

  • GLM-5.3 modelinin güvenlik filtreleri eğitim yapılmadan doğrudan ağırlık matrisleri düzenlenerek kaldırıldı.
  • v2 sürümünde zorlayıcı komutlarda ortaya çıkan akıl yürütme döngüsü hataları sıfırlandı.
  • Model, genel bilgi kıyaslaması MMLU testinde temel modele göre yüzde 87,43 başarı oranı yakaladı.

Yapay zeka araştırma grubu dealignai, 753 milyar parametreli GLM-5.3 büyük dil modelinin doğrudan ağırlık düzeyinde sansürsüzleştirilmiş sürümünü Hugging Face üzerinden paylaştı. GLM-5.3-UNCENSORED-FP8 adlı model, ince ayar veya LoRA gibi eğitim süreçleri yerine artık yazıcı tensörlerindeki kalıcı bf16 ağırlık değişiklikleri yoluyla güvenlik filtrelerini kaldırıyor.

Geliştiriciler, v2 sürümüyle birlikte v1 varyantında telif hakkı ve kimyasal silah gibi zorlayıcı komutlarda görülen akıl yürütme döngüsü çöküşlerini giderdi. Test sonuçlarına göre model, HarmBench-320 güvenlik ölçütündeki telif dışı 240 zararlı davranış testinde yüzde 90'ın üzerinde uyumluluk sergilerken genel bilgi ölçümü olan MMLU skorunu temel modele kıyasla korumayı başardı.

Hopper mimarisindeki H100 ve H200 GPU'larda yerel FP8 desteğiyle çalışan model, standart vLLM altyapısıyla dağıtılabiliyor. Geliştirici ekip, MIT lisansıyla yayımlanan bu ağırlıkların yalnızca araştırma, kırmızı takım testleri ve yaratıcı yazarlık amacıyla kullanılması gerektiğini belirtti.

Kaynak

Bu özet yapay zekâ ile hazırlanmıştır; ayrıntılar ve doğrulama için orijinal kaynağa başvurun.