Yapay zeka kaynaklı kod yorumlarını tespit eden tarayıcı içi sınıflandırıcı geliştirildi
Öne çıkanlar
- Sınıflandırıcı, tüm çıkarım sürecini sunucuya veri göndermeden kullanıcının tarayıcısında tamamlıyor.
- Model çapraz doğrulamada yüzde 77, gerçek dünya testlerinde ise yüzde 88 dengeli doğruluk sağladı.
- Sözcük türü etiket dizilimleri (POS n-gram), insan ile yapay zeka ayrımında en güçlü sinyali üretti.
Geliştirici, kod yorumlarının insan veya büyük dil modelleri tarafından yazıldığını ayırt edebilen yeni bir sınıflandırıcı yayımladı. Önceki sürümün aksine halka açık verilerle sıfırdan eğitilen araç, kullanıcı verilerini sunucuya göndermeden tamamen tarayıcı üzerinde çalışıyor. Arayüz üzerinden metnin hangi özelliklerinin kararı nasıl etkilediği doğrudan görüntülenebiliyor.
Eğitim verisi için 2021 yılına ait açık kaynaklı depolardaki kod yorumları temizlendi ve GPT, Claude, Gemini ile Grok gibi farklı modellere yeniden yazdırıldı. Çapraz doğrulama testlerinde model dengeli olarak yüzde 77 doğruluk ve yüzde 80 duyarlılık oranına ulaştı. Gerçek dünya örnekleriyle yapılan bağımsız testlerde ise doğruluk oranı yüzde 88 seviyesine çıktı.
Sistem, metin uzunluğu ve işlev kelimelerinin yanı sıra sözcük türü (POS) dizilimleri ve karakter sıklıklarını analiz eden çoklu öznitelik haritasından yararlanıyor. Geliştirici, ilk aşamada yedi farklı kaynağı ayırt etmek üzere kurgulanan yapının sonuçlarını insan ve yapay zeka ikili kararına dönüştürerek kalibre edilmiş olasılık puanı ürettiğini aktardı.
Bu özet yapay zekâ ile hazırlanmıştır; ayrıntılar ve doğrulama için orijinal kaynağa başvurun.