Tagged: AI Security
Sicurezza dei sistemi AI: adversarial examples, data/model poisoning, prompt injection.
Termini
Adversarial Examples
Input manipolati ad arte, con perturbazioni spesso impercettibili all'uomo, che inducono un modello di machine learning a produrre classifi…
Data Poisoning
Attacco che compromette intenzionalmente i dataset usati per addestrare un modello di machine learning, inserendo o alterando dati per degr…
Model Extraction Attack
Attacco con cui un avversario interroga ripetutamente un modello di machine learning per ricostruirne parametri, struttura o dati di addest…
Model Poisoning
Attacco contro sistemi di machine learning che altera i dati o i parametri durante l'addestramento, compromettendo l'accuratezza del modell…
Prompt Injection
Manipolazione dell'input fornito a un modello linguistico o sistema di AI per indurlo a ignorare le proprie istruzioni, eseguire azioni non…