Distrugeți o imagine cu zgomot, apoi învățați să inversați procesul. Modelele de difuzie se antrenează adăugând treptat zgomot la date, apoi învățând să elimine zgomotul pas cu pas. Odată antrenate, acestea pot porni de la zgomot pur și pot genera noi eșantioane care arată ca distribuția de antrenament.
Această abordare stă la baza multor generatoare de imagini actuale. Calitatea este ridicată, iar obiectivul de antrenament este stabil în comparație cu rețelele generative adverse, care pot suferi de colapsul modurilor și dinamică instabilă.
Etape cheie
- Proces înainte, adăugând zgomot pe parcursul mai multor etape
- Proces invers, învățarea eliminării zgomotului
- Eșantionare, generare din zgomot aleatoriu
- Condiționarea, ghidarea ieșirii cu text sau alte intrări
Costul este viteza. Generarea unei singure imagini poate necesita zeci sau sute de treceri de rețea. Distilarea și eșantionatoarele mai rapide reduc numărul de pași, dar difuzia rămâne o metodă de calcul mai intensivă decât unele alternative.
Comments
No comments yet. Be the first to share a thought.
Leave a comment