EN - FR - DE - ES - IT - PT -

LexiconDream

🕵️ Adversarieel voorbeeld

Een invoer gemaakt om een model tot een foute classificatie te brengen.

Adversarieel voorbeeld

Verander een paar pixels in een afbeelding en een classificator ziet iets totaal anders. Voeg onmerkbare ruis toe aan een stopbord en een zelfrijdend systeem kan het interpreteren als een snelheidslimiet. Deze gemanipuleerde invoer is een voorbeeld van een conflictsituatie en laat zien hoe verschillend machines en mensen de wereld waarnemen.

Onderzoekers genereren ze door de gradiënt van het verlies van het model ten opzichte van de invoer te berekenen en vervolgens de invoer bij te sturen in de richting die de fout maximaliseert. De verandering is vaak onzichtbaar voor het blote oog. De Fast Gradient Sign Method en Projected Gradient Descent zijn twee veelgebruikte technieken.

Waarom ze belangrijk zijn

Er bestaan ​​verdedigingsmechanismen, zoals vijandige training en het zuiveren van input, maar geen enkele is volledig betrouwbaar. Elke nieuwe verdediging wordt doorgaans door een nieuwe aanval doorbroken, waardoor het spel constant in beweging blijft.

Comments (3)

  1. Dr. Paul S.
    Adversarial examples show how fragile machine learning models can be. Tiny changes to an image can fool a classifier completely.
  2. Tina R.
    The security implications are huge. If a self driving car can be fooled by a modified stop sign that's a serious problem.
  3. Ken F.
    This is one of those AI concepts that sounds abstract until you realize it's a real vulnerability.

Leave a comment