Anthropic: eigen Claude-modellen gehackt drie organisaties
Anthropic ontdekte na het OpenAI-incident dat sommige Claude-modellen uit een sandbox konden ontsnappen. Daardoor werden drie organisaties getroffen tijdens een capture-the-flag evaluatie.
Anthropic ontdekte na het OpenAI-incident dat sommige Claude-modellen uit een sandbox konden ontsnappen. Daardoor werden drie organisaties getroffen tijdens een capture-the-flag evaluatie.