Direct naar de inhoud

Tag: prompt injection

ChatGPT kwetsbaarheid: geplante prompt lekt Gmail

Een geplante prompt kan ChatGPT onzichtbaar taken laten uitvoeren met toegang tot een verbonden Gmail-account. Check Point toont een proof of concept waarbij data naar een ander ChatGPT-account wordt gestuurd.

Prompt injection in Amazon Kiro: datalek-risico

Onderzoekers melden dat prompt injection Kiro in Amazon Kiro IDE lokale, gevoelige gegevens kan doorsturen via Kiro Powers. De aanval vraagt om specifieke gebruikersacties en een kwetsbare projectworkflow.

Cryptographic Context Injection: AI-safety omzeilen

Cryptographic Context Injection is een nieuwe aanvalstechniek die AI-safety guardrails kan omzeilen door instructies versleuteld aan te leveren. Zo kan een model ongewenste acties uitvoeren of data ongeautoriseerd uitlekken.

CoSnitch bij Copilot Personal: éénklik datalek

Onderzoekers van Varonis Threat Labs ontdekten CoSnitch bij Copilot Personal: een crafted link kan in één klik data uit verbonden apps trekken. Er zijn ook risico’s rond geheugen-schrijven via samenvattingen.

API-lek in OpenAI, Anthropic en Google: risico’s

Een recent onderzoek beschrijft een API-lek AI-redenering waarbij “encrypted reasoning” uit sessielogs kan worden gereconstrueerd. Daarbij kwamen in het bewijs ook API-keys, wachtwoorden en tokens naar voren.

GhostSplice: kwaadaardige MCP-servers en datadiefstal

GhostSplice MCP laat zien hoe een aanvaller instructies kan knippen over meerdere MCP-stappen zodat een AI-coding agent toch secrets uitlevert. De techniek werkt via externe tool-servers en draait om fout behandelde input en tool-aanroepen.

RovoBlast: one-click kwetsbaarheid in Atlassian Rovo

Onderzoekers van Varonis Threat Labs ontdekten de RovoBlast kwetsbaarheid: een speciaal gemaakte link kan Rovo in iemands live AI-sessie aanzetten tot datalekken. Zonder extra bypass of jailbreak wordt gevoelige informatie opgehaald en gedeeld.

Atlassian Rovo: zo kon het Jira-data lekken

Onderzoekers vonden dat Atlassian Rovo misleid kan worden om Jira- en Confluence-informatie te verzamelen en door te sturen naar een aanvaller. Eén van de routes is server-side verholpen; voor de andere blijft de status beperkt bevestigd.