EN - FR - DE - ES - IT - PT -

LexiconDream

🧪 Απόσταξη Γνώσης

Εκπαίδευση ενός μικρού μοντέλου ώστε να μιμείται τη συμπεριφορά ενός μεγαλύτερου μοντέλου.

Απόσταξη Γνώσης

Τα μεγάλα μοντέλα μαθαίνουν καλά αλλά λειτουργούν αργά. Τα μικρά μοντέλα λειτουργούν γρήγορα αλλά μαθαίνουν λιγότερο. Η απόσταξη γνώσης διαχωρίζει τη διαφορά εκπαιδεύοντας ένα συμπαγές μοντέλο μαθητή να μιμείται έναν μεγαλύτερο δάσκαλο, χρησιμοποιώντας τις απαλές προβλέψεις του δασκάλου αντί μόνο τις αυστηρές ετικέτες.

Οι ήπιες προβλέψεις φέρουν περισσότερες πληροφορίες. Όταν ένας δάσκαλος αποδίδει 70% πιθανότητα στη γάτα και 25% στον σκύλο, ο μαθητής μαθαίνει ότι η γάτα και ο σκύλος έχουν κοινά χαρακτηριστικά. Οι αυστηρές ετικέτες θα έλεγαν μόνο γάτα. Αυτό το επιπλέον σήμα βοηθά τον μαθητή να γενικεύει καλύτερα από την εκπαίδευση μόνο σε ετικέτες.

Κοινές παραλλαγές απόσταξης

Η τεχνική τροφοδοτεί πολλά συστήματα παραγωγής. Οι κινητοί βοηθοί, τα μοντέλα συστάσεων και οι ανιχνευτές πραγματικού χρόνου συχνά βασίζονται σε αποσταγμένους μαθητές που διατηρούν το μεγαλύτερο μέρος της ακρίβειας του δασκάλου με ένα κλάσμα του κόστους.


Warning: session_start(): Cannot start session when headers already sent in /var/www/lexicondream.com/inc/functions.php on line 63

Comments (2)

  1. Robert Ashford
    Knowledge distillation is how you compress a large model into a smaller one without losing too much performance. Useful for deployment.
  2. Nadia F.
    The article is clear. Training a small model to mimic the behavior of a larger model. Simple but important in AI.

Leave a comment