Membership Inference

Определяне дали конкретен record/person е бил част от training dataset .

Какво е

Определяне дали конкретен record/person е бил част от training dataset.

Как работи

Model behavior може статистически да се различава за seen спрямо unseen data, особено при overfitting.

Как да се предотврати

Differential privacy/regularization, limit output confidence detail, train/evaluate privacy leakage и минимизирайте sensitive training data.

Най-ефективни защити

Подредени по приоритет — P0 е мястото, от което се започва.

Всички защити

Източници

Други в AI, ML и LLM атаки