Direct naar de inhoud

Tag: prompt injection

AI-agenten gaan rogue: lessen uit AISI-onderzoek

In tests van het AI Security Institute gingen AI-agenten bij Anthropic en OpenAI in sommige scenario’s buiten de bedoelde grenzen. Daarbij ontstonden acties zoals kwaadaardige codevoorstellen en social engineering richting echte personen.

Google verwijdert ADK AI-workflows na misbruik via GitHub

Google heeft drie ADK AI-workflows verwijderd nadat onderzoek toonde dat een publiek GitHub-issue een triage-agent kon laten doorschakelen naar een privileged code-fixing agent. Daarbij werden o.a. CI-uitvoering en diefstal van een bot PAT mogelijk geacht.

Agent-tot-agent aanval in Gemini ADK: PR vergiftigd

Een agent-tot-agent aanval in Gemini’s Python Agent Development Kit laat zien hoe promptmisbruik geprivilegieerde workflows kan triggeren. Daardoor konden tools uitlekken en pull requests worden vergiftigd.