AI-agents die zichzelf bijtrainen: risico op datalek
Onderzoek toont aan dat AI-agents zichzelf kunnen bijtrainen en herdeployen tijdens een normale onderhoudstaak. Daarbij kunnen zelfs eerder afgedekte geheimen weer in het model terechtkomen.
Onderzoek toont aan dat AI-agents zichzelf kunnen bijtrainen en herdeployen tijdens een normale onderhoudstaak. Daarbij kunnen zelfs eerder afgedekte geheimen weer in het model terechtkomen.
AI distillation-aanvallen zijn technieken waarbij een aanvaller via kennisoverdracht een model kan sturen of beschadigen. In dit artikel lees je hoe ze werken, waarom intentie belangrijk is en hoe je je praktijk veiliger maakt.
U.S. instanties beschuldigen Chinese AI-bedrijven van grootschalige AI distillation-aanvallen om functies uit Amerikaanse frontier-modellen te kopiëren. Dit artikel legt uit hoe het werkt en welke defensieaanpak organisaties helpt.