Zničte obraz šumem a poté se naučte proces obrátit. Difuzní modely se trénují postupným přidáváním šumu k datům a následným učením se krok za krokem odšumovat. Po natrénování mohou začít s čistým šumem a generovat nové vzorky, které vypadají jako trénovací rozdělení.
Tento přístup je základem mnoha dnešních generátorů obrázků. Kvalita je vysoká a trénovací cíl je stabilní ve srovnání s generativními adverzárními sítěmi, které mohou trpět kolapsem módů a nestabilní dynamikou.
Klíčové fáze
- Proces vpřed, přidávání šumu v mnoha krocích
- Opačný proces, učení se odšumování
- Vzorkování, generování z náhodného šumu
- Podmiňování, vedení výstupu textem nebo jiným vstupem
Cenou je rychlost. Generování jednoho obrazu může vyžadovat desítky nebo stovky průchodů sítí. Destilace a rychlejší vzorkovače snižují počet kroků, ale difúze zůstává výpočetně náročnější než některé alternativy.
Comments
No comments yet. Be the first to share a thought.
Leave a comment