Intelligenza Artificiale (IA) sotto attacco con il data poisoning

I dati sono la risorsa più preziosa dell’ultimo millennio, in termini economici e tecnologici. Su di essa si fonda il nuovo ecosistema dell’intelligenza artificiale (AI).

Questo immenso patrimonio informativo attira le attenzioni dei criminal hacker sempre pronti ad adottare (e adattare) vecchie e nuove tecniche di attacco per manipolarli: tra tutte, il data poisoning rappresenta una seria sfida per i cyber security analyst.

Gli algoritmi AI necessitano di enormi quantità di dati per l’addestramento, molti dei quali provengono dal web e sono vulnerabili a manipolazioni. Il data poisoning si verifica proprio quando un attaccante altera i dati di training, inserendo informazioni errate nel sistema per distorcere il comportamento del modello AI.

Esistono due principali tipi di attacco con il data poisoning:

  1. Attacchi alla precisione: riduzione dell’accuratezza complessiva del modello AI iniettando dati corrotti nel dataset di training;
  2. Attacchi alla sicurezza (backdoor attacks): manipolazione del modello per farlo funzionare correttamente, salvo quando l’attaccante utilizza un input specifico che lo induce a generare risultati errati.

Questi attacchi minano l’affidabilità delle previsioni dell’AI e possono avere conseguenze critiche in diversi settori di applicazione come sanità, finanza e cybersecurity.

L’adversarial access, ovvero il livello di accesso dell’attaccante, determina la profondità del data poisoning.

Questo può avvenire a tre diversi livelli:

  • Manipolazione della logica: modifica diretta dell’algoritmo AI;
  • Manipolazione dei dati: alterazione o eliminazione dei dati di training;
  • Iniezione di dati: aggiunta di dati ingannevoli al dataset.

Le tecniche di difesa da questo tipo di attacchi includono:

  • Sanificazione dei dati: applicazione di tecniche di rilevamento dei valori anomali per identificare e rimuovere dati sospetti o manipolati dal set di addestramento;
  • Controllo dell’accesso: limitazione dell’accesso ai dati di addestramento e garanzia che solo il personale autorizzato possa modificarli;
  • Validazione dei dati: verifica dell’origine e dell’integrità dei dati utilizzati per l’addestramento, preferendo fonti affidabili e certificate;
  • Monitoraggio continuo: implementazione di sistemi di monitoraggio per rilevare comportamenti anomali nei modelli durante e dopo l’addestramento.

È essenziale proteggere i dati e assicurarsi che i criminali non possano accedervi. Ecco perché l’archiviazione dei dati in un ambiente sicuro è importante. Inoltre, è cruciale costruire modelli d’intelligenza artificiale solo con dati rilevanti. Più dati si inseriscono nel modello, più è probabile che gli attaccanti trovino qualcosa che lo “avvelena”. Il data poisoning evidenzia la continua sfida tra cybercriminali e difensori, rendendo necessarie strategie di protezione sempre più sofisticate.

Fonte: IBM, What is data poisoning, 10 dicembre 2024. Cybersecurity360, L’intelligenza artificiale può essere attaccata? Cos’è il data poisoning e come difendersi, 12 maggio 2023

Vuoi semplificare e velocizzare i tuoi processi?