Anthropic stelt dat gebruikers in noordelijk Jemen Claude misbruikt hebben om software te helpen ontwikkelen voor raketten en geleiding. De poging leidde niet tot een operationeel wapen, maar wel tot een mislukte test.
Onderzoek van Pistachio laat zien dat alleen sturen op kliks een vals gevoel van veiligheid kan geven. Echte vooruitgang blijkt uit het samenspel van klik-, lek- en meldgedrag.
Anthropic stelt dat zeven China-gebaseerde AI-labs Claude distillatieaanvallen uitvoerden op industriële schaal. Ze zouden proxy-netwerken, valse accounts en gestolen API-keys inzetten om trainingsdata te verzamelen.
WatchTowr ziet al binnen één dag na publicatie misbruikpogingen voor een kritieke GitLab kwetsbaarheid. Zelf-hosted teams moeten direct updaten en gericht in logs zoeken.
Anthropic waarschuwt dat criminelen én staatsspelers Claude inzetten voor cyberaanvallen, datadiefstal en beïnvloedingscampagnes. Het rapport beschrijft hoe de inzet varieert van assistentie tot (bijna) autonome operaties.
In deze update lees je AI distillation-aanvallen uitgelegd met een bredere context: van onzichtbare tekens bij phishing tot side-channel misbruik en een kritische blik op kwetsbaarheidsrapportage.
Anthropic beschrijft hoe een Russische, door de staat gesteunde actor Claude inzet in een AI-gestuurde aanpak om malware na detectie opnieuw te bouwen. Zo wordt statische detectie minder effectief en verschuift de werklast naar verdedigers.
In dit artikel lees je AI distillation-aanvallen uitgelegd: hoe aanvallers via afleiding en modelmisbruik proberen beperkingen te omzeilen. Ook krijg je praktische aandachtspunten voor AI-veiligheid.
Een dreigingsrapport van Anthropic beschrijft hoe een Russische actor Claude inzette om malware-detectie te omzeilen. Door de detectielus te automatiseren komt de bewijslast sneller bij verdedigers te liggen.
Een China-linked groep maakte misbruik van een kwetsbaarheid in Sogou Input Method om de GRAYRABBIT-backdoor te installeren. Tencent leverde de fix in april 2026 via automatische updates.