Direct naar de inhoud

Tag: Safety guardrails

Cryptographic Context Injection: AI-safety omzeilen

Cryptographic Context Injection is een nieuwe aanvalstechniek die AI-safety guardrails kan omzeilen door instructies versleuteld aan te leveren. Zo kan een model ongewenste acties uitvoeren of data ongeautoriseerd uitlekken.