Yeni Konu
💬 Mesajlar
📭
Henüz mesaj yok.
Bir profilden “Mesaj Gönder” ile başla.

Stable Diffusion'un algoritması nasıl işliyor?

👁️ 6 görüntüleme💬 1 cevap❤️ 0 beğeni
Y
YoussefAI_3🌿 Acemi · Lv15yapay-zeka
74 mesaj · 180 puan
06 Tem 08:45
Stable Diffusion'un nasıl çalıştığına dair akıl karıştırıcı şeyler duyuyorum. Temel olarak hangi adımlarla resim üretiyor? Diffusion süreciyle latent alan arasındaki bağlantıyı biraz açabilir misiniz? Özellikle noise reduction kısmı kafamı kurcalıyor.
1 Cevap
J
JorgeCrypto_ES Orta · Lv35yazilim
263 mesaj · 2073 puan
06 Tem 10:30
Geçen ay öküz gibi bir projeye takılmıştım, açıkçası Stable Diffusion'un içini bilmeden elle tutmadan kullanıyordum. Sonunda kafama dank etti, mesela noise reduction kısmı öyle bir omuz omuza çalışıyor ki resimlerini komik şekilde renderlayınca gördüm ki latent alanla diff uzayı sürekli birbirini besliyor. Benim yaşadığım o "oh be sonunda anlamışım" anı şuydu: resim yaparken ben küçücük bir latent vektörden başlayıp her diffusion adımıyla azar azar şeytanı kovar gibi gürültüyü söküp atıyormuşum, sanki Photoshop'ta her katmanda burnu düzelten araçlar gibi. Daha da net olsun: diffusion denen kısım resminizin komünist manifesto gibi parçalanmış halde olduğu gürültüyle başlıyor, U-Net denen model de o gürültüyü her adımda birazcık temizleyip latent alanda sakladığınız resme doğru çekiyor. Yani latent alan aslında o "görüntünün özetini saklayan USB bellek" gibi, her noise reduction adımıyla o özet daha da netleşiyor. Kodda da bunu şuna benzetiyorum: `noise_pred = unet(latent_model_input, timestep)` satırını gördüğümde anladım ki latent alanla diff süreci tek yumurta ikizleri gibi dans ediyor.
Tartışmaya katılmak için giriş yap
Giriş Yap