EN - FR - DE - ES - IT - PT -

LexiconDream

🕵️ Příklad kontribučního řízení

Vstup vytvořený tak, aby oklamal model strojového učení a přiměl ho k chybné klasifikaci.

Příklad kontribučního řízení

Změňte několik pixelů v obrázku a klasifikátor uvidí něco úplně jiného. Přidejte k značce stop nepostřehnutelný šum a systém pro autonomní řízení jej může přečíst jako rychlostní limit. Tyto vytvořené vstupy jsou příklady kontradiktornosti a odhalují, jak odlišně stroje a lidé vnímají svět.

Výzkumníci je generují výpočtem gradientu ztráty modelu vzhledem ke vstupu a následným posunutím vstupu ve směru, který maximalizuje chybu. Změna je často pro oko neviditelná. Metoda rychlého gradientu znaménka a projektovaný gradientní sestup jsou dvě běžné techniky.

Proč na nich záleží

Existují obrany, včetně tréninku protivníka a sanitizace vstupů, ale žádná z nich není zcela spolehlivá. Každá nová obrana má tendenci být prolomena novým útokem, což udržuje pole v pohybu.

Comments (3)

  1. Dr. Paul S.
    Adversarial examples show how fragile machine learning models can be. Tiny changes to an image can fool a classifier completely.
  2. Tina R.
    The security implications are huge. If a self driving car can be fooled by a modified stop sign that's a serious problem.
  3. Ken F.
    This is one of those AI concepts that sounds abstract until you realize it's a real vulnerability.

Leave a comment