Persistent AI Memory/Context Poisoning

Злонамерена информация се записва в long-term memory/profile/context store и влияе на бъдещи sessions.

Какво е

Злонамерена информация се записва в long-term memory/profile/context store и влияе на бъдещи sessions.

Как работи

Един malicious interaction оставя instruction/fact, който се retrieval-ва по-късно и става persistent behavioral influence.

Как да се предотврати

Separate user facts from executable instructions, provenance/timestamps, review/delete controls, scoped memory, sanitize imported content и policy that retrieved memory is data, not authority.

Най-ефективни защити

Подредени по приоритет — P0 е мястото, от което се започва.

Всички защити

Други в AI, ML и LLM атаки