EN - FR - DE - ES - IT - PT -

LexiconDream

🕵️ Przykład przeciwstawny

Dane wejściowe opracowane w celu wprowadzenia w błąd modelu uczenia maszynowego i dokonania błędnej klasyfikacji.

Przykład przeciwstawny

Zmieniając kilka pikseli na obrazie, klasyfikator dostrzega coś zupełnie innego. Dodaj niezauważalny szum do znaku stop, a system autonomicznej jazdy może go odczytać jako ograniczenie prędkości. Te spreparowane dane wejściowe to przykłady antagonistyczne, które ujawniają, jak odmiennie maszyny i ludzie postrzegają świat.

Naukowcy generują je, obliczając gradient straty modelu względem danych wejściowych, a następnie przesuwając dane wejściowe w kierunku maksymalizującym błąd. Zmiana ta jest często niewidoczna gołym okiem. Metoda szybkiego znaku gradientu i rzutowany spadek gradientu to dwie popularne techniki.

Dlaczego są ważne

Istnieją mechanizmy obronne, w tym treningi adwersarzy i oczyszczanie danych wejściowych, ale żaden z nich nie jest w pełni niezawodny. Każda nowa obrona zazwyczaj zostaje przełamana przez nowy atak, co utrzymuje pole bitwy w ruchu.

Comments (3)

  1. Dr. Paul S.
    Adversarial examples show how fragile machine learning models can be. Tiny changes to an image can fool a classifier completely.
  2. Tina R.
    The security implications are huge. If a self driving car can be fooled by a modified stop sign that's a serious problem.
  3. Ken F.
    This is one of those AI concepts that sounds abstract until you realize it's a real vulnerability.

Leave a comment