Nieuws

Prompt-injectieaanvallen dwarsbomen AI-hackagents

Onderzoekers van Tracebit hebben context bombing ontwikkeld, een techniek die prompt-injecties gebruikt om schadelijke AI-agents uit te schakelen. Door verboden commando's naast AWS-secrets te plaatsen, worden aanvallende LLM's gedwongen te stoppen. Tests met onder andere Gemini en DeepSeek toonden een daling van succesvolle aanvallen van 57% naar 5% voor admin-escalatie.

Bron: WIRED AI

Originele taal: [en-US]

Lees hier het originele artikel

Dossier: