Flyttal är exakta men tunga. Kvantisering minskar den numeriska precisionen för modellvikter och aktiveringar, vanligtvis från 32-bitars flyttal till 8-bitars eller 4-bitars heltal. Modellen krymper, körs snabbare och använder mindre ström.
Avvägningen är noggrannhet. Aggressiv kvantisering försämrar utdatakvaliteten, särskilt på uppgifter som kräver fina numeriska distinktioner. Kvantisering efter träning är billigt men förlustbringande. Kvantiseringsmedveten träning simulerar låg precision under träningen och återställer mycket av den förlorade noggrannheten.
Vanliga kvantiseringsnivåer
- 16-bitars flyttal, mindre komprimering
- 8-bitars heltal, används ofta för inferens
- 4-bitars heltal, aggressivt men genomförbart med försiktighet
- Binär och ternär, experimentell
Hårdvarustödet varierar. Vissa acceleratorer hanterar 8-bitars data direkt och ger stora hastighetsökningar. Andra använder långsammare vägar. Att välja ett kvantiseringsschema beror lika mycket på distributionsmålet som på modellen.
Comments
No comments yet. Be the first to share a thought.
Leave a comment