Τροφοδοτήστε έναν παραλλαγμένο αυτόματο κωδικοποιητή με χιλιάδες φωτογραφίες προσώπων και θα μάθει έναν συμπιεσμένο χάρτη για το πώς μοιάζουν τα πρόσωπα και στη συνέχεια θα δημιουργήσει νέους που δεν υπήρξαν ποτέ. Το μοντέλο ανήκει στην οικογένεια των γενετικών κωδικοποιητών και το διακριτικό του χαρακτηριστικό είναι μια πιθανοτική παραλλαγή του συνηθισμένου αυτόματου κωδικοποιητή.
Ένας τυπικός αυτόματος κωδικοποιητής συμπιέζει την είσοδο σε ένα σταθερό διάνυσμα και την ανακατασκευάζει. Ένας VAE κωδικοποιεί κάθε είσοδο ως κατανομή, συνήθως έναν μέσο όρο και μια διακύμανση, και στη συνέχεια λαμβάνει δείγματα από αυτήν την κατανομή πριν από την αποκωδικοποίηση. Αυτή η αναγκαστική τυχαιότητα εξομαλύνει τον λανθάνοντα χώρο έτσι ώστε τα κοντινά σημεία να αποκωδικοποιούνται σε παρόμοιες εξόδους, γεγονός που καθιστά την παρεμβολή και τη δειγματοληψία ουσιαστική.
Βασικά συστατικά
- Ένα δίκτυο κωδικοποιητών που εξάγει παραμέτρους μιας λανθάνουσας κατανομής
- Ένα βήμα δειγματοληψίας χρησιμοποιώντας το κόλπο επαναπαραμετροποίησης για να διατηρηθούν οι διαβαθμίσεις ρέουσες
- Ένα δίκτυο αποκωδικοποιητών που ανακατασκευάζει την είσοδο από ένα δειγματοληπτικό λανθάνον διάνυσμα
- Μια απώλεια που συνδυάζει σφάλμα ανακατασκευής με έναν όρο απόκλισης KL που κανονικοποιεί τον λανθάνοντα χώρο
Τα VAE παράγουν πιο θολές εικόνες από τα GAN, αλλά οι λανθάνοντες χώροι τους είναι πιο δομημένοι και πιο εύκολοι στην πλοήγηση. Αυτό το συμβιβασμό τα κρατά δημοφιλή για την ανακάλυψη φαρμάκων, την ανίχνευση ανωμαλιών και οποιαδήποτε εργασία όπου μια ομαλή, ερμηνεύσιμη αναπαράσταση έχει μεγαλύτερη σημασία από την τέλεια ευκρίνεια pixel.
Comments
No comments yet. Be the first to share a thought.
Leave a comment