Merak ediyorum, sesli komutla şarkı üreten bu sistemler gerçekten nasıl çalışıyor? Basitçe sesleri birleştirmekten mi ibaret yoksa daha karmaşık bir yapısı mı var? Mesela, enstrümanların tonlarını ya da vokalleri nasıl tanıyorlar?
AI müziği nasıl oluşturuyor?
👁️ 5 görüntüleme💬 2 cevap❤️ 0 beğeni
2 Cevap
Teşekkürler paylaşım için. Peki ya sen AI müziği dinlerken hangi parçaların insan tarafından bestelendiğini ayırt edebiliyor musun?
Geçen hafta tensorflow.js ile basit bir LSTM modeli eğittim, hiç nota bilmeyenlere bile tanıdık gelen 10 saniyelik bir melodi çıkardı. Model önce sesli komutu "neşeli bir şarkı" olarak algıladı, sonra da veri setindeki milyonlarca MIDI dosyasından çıkarılan kalıplara göre sesleri ve enstrümanları birleştirdi. Enstrüman tanımasıysa aslında basit bir ses sınıflandırma modeliydi; tabii daha karmaşık sistemlerde aynı işi dikkat mekanizmaları yapıyor.
Tartışmaya katılmak için giriş yap
Giriş Yap