RAG / Vector-Database Poisoning

Manipulation на retrieval corpus, embeddings, metadata или indexing, така че Retrieval-Augmented Generation да получава malicious или misleading context.

Какво е

Manipulation на retrieval corpus, embeddings, metadata или indexing, така че Retrieval-Augmented Generation да получава malicious или misleading context.

Как работи

Attacker добавя document, SEO-style content или changed ACL/metadata, който rank-ва високо за важни queries и влияе върху model output.

Как да се предотврати

Source provenance, signed/approved knowledge sources, ACL-aware retrieval, document change review, trust-weighted ranking и detection на unusual retrieval dominance.

Най-ефективни защити

Подредени по приоритет — P0 е мястото, от което се започва.

Всички защити

Други в AI, ML и LLM атаки