Ana içeriğe geç
Yapay Zeka

StemDeck yerel yapay zeka ile ses kanallarını ayırıyor

Öne çıkanlar

  • Meta AI'ın Demucs modeliyle sesleri vokal, bas, davul, piyano ve gitar dahil altı kanala ayırıyor.
  • Tüm işleme süreçlerini yerel donanımda yürüterek harici sunucuya veri aktarımını engelliyor.
  • Windows, macOS ve Docker ortamlarında abonelik gerektirmeden açık kaynaklı çalışıyor.

Geliştiriciler, ses dosyalarını yapay zeka yardımıyla enstrüman ve vokal kanallarına ayıran açık kaynaklı StemDeck uygulamasını kullanıma sundu. Tamamen kullanıcının kendi cihazında çalışan araç, MP3, WAV, FLAC gibi yaygın ses formatlarının yanı sıra video ve YouTube bağlantılarını da işleyebiliyor. Bulut tabanlı benzerlerinin aksine üyelik veya abonelik gerektirmeyen yazılım, verileri dış sunuculara göndermeden altı farklı kanala kadar ayrıştırma yapıyor.

Meta AI tarafından geliştirilen açık kaynaklı Demucs modelini temel alan uygulama, vokalleri, davulu, bası, gitarı, piyanoyu ve diğer ses ögelerini bağımsız parçalara bölüyor. Sistem, donanım özelliklerine göre NVIDIA CUDA, Apple Silicon MPS veya doğrudan işlemci kaynaklarını otomatik olarak seçiyor. Kullanıcılar, dahili mikser arayüzü üzerinden dalga formlarını inceleyebiliyor, kanalları tek tek susturup dinleyebiliyor ve özel miksler oluşturup dışa aktarabiliyor.

FastAPI ve Rust tabanlı Tauri v2 ile inşa edilen StemDeck, Windows ve macOS için bağımsız yükleyiciler şeklinde sunuldu. Proje ayrıca Docker konteyneri olarak veya Python ortamı üzerinden yerel sunucu şeklinde de çalıştırılabiliyor.

Kaynak

Bu özet yapay zekâ ile hazırlanmıştır; ayrıntılar ve doğrulama için orijinal kaynağa başvurun.