EN - FR - DE - ES - IT - PT -

LexiconDream

🔙 Zpětné šíření

Algoritmus, který počítá gradienty pro aktualizaci vah neuronové sítě.

Zpětné šíření

Trénování sítě vyžaduje vědět, jak upravit každou váhu. To se počítá metodou zpětného šíření chyby (backpropagation). Aplikuje řetězové pravidlo diferenciálního počtu k šíření chyby z výstupní vrstvy zpět skrz síť a přiřazuje gradient každé váze na cestě.

Algoritmus pracuje ve dvou průchodech. Vpředný průchod počítá predikce a ztráty. Zpětný průchod počítá gradienty s ohledem na každý parametr. Optimalizátor, podobný stochastickému gradientnímu sestupu, poté aktualizuje váhy ve směru, který snižuje ztráty.

Klíčové kroky

Tato technika se zpopularizovala v 80. letech 20. století a ve spojení s rychlejším hardwarem a lepšími aktivačními funkcemi učinila hluboké učení praktickým. Bez ní by trénování vícevrstvých sítí vyžadovalo obtížné prohledávání váhového prostoru.

Comments (2)

  1. Grad student
    Vanishing gradients were a real headache before better activations and residual connections.
  2. Deep learning hobbyist
    The algorithm that makes training neural nets practical. Chain rule applied repeatedly is the core idea.

Leave a comment