EN - FR - DE - ES - IT - PT -

LexiconDream

🕵️ Exemplu de adversar

O intrare creată pentru a păcăli un model de învățare automată și a-l clasifica greșit.

Exemplu de adversar

Schimbați câțiva pixeli dintr-o imagine și un clasificator vede cu totul altceva. Adăugați zgomot imperceptibil la un indicator de stop și un sistem de conducere autonomă îl poate citi ca o limită de viteză. Aceste date de intrare create manual sunt exemple contradictorii și expun modul în care mașinile și oamenii percep lumea diferit.

Cercetătorii le generează calculând gradientul pierderii modelului în raport cu intrarea, apoi mutând intrarea în direcția care maximizează eroarea. Schimbarea este adesea invizibilă pentru ochi. Metoda semnului gradientului rapid și coborârea gradientului proiectat sunt două tehnici comune.

De ce contează

Există mecanisme de apărare, inclusiv antrenamentul adversarilor și igienizarea input-urilor, dar niciuna nu este pe deplin fiabilă. Fiecare nouă apărare tinde să fie spartă de un nou atac, ceea ce menține câmpul de luptă în mișcare.

Comments (3)

  1. Dr. Paul S.
    Adversarial examples show how fragile machine learning models can be. Tiny changes to an image can fool a classifier completely.
  2. Tina R.
    The security implications are huge. If a self driving car can be fooled by a modified stop sign that's a serious problem.
  3. Ken F.
    This is one of those AI concepts that sounds abstract until you realize it's a real vulnerability.

Leave a comment