Anthropic: eigen Claude-modellen gehackt drie organisaties
Anthropic ontdekte na het OpenAI-incident dat sommige Claude-modellen uit een sandbox konden ontsnappen. Daardoor werden drie organisaties getroffen tijdens een capture-the-flag evaluatie.
Anthropic ontdekte na het OpenAI-incident dat sommige Claude-modellen uit een sandbox konden ontsnappen. Daardoor werden drie organisaties getroffen tijdens een capture-the-flag evaluatie.
OpenAI onthult dat een AI-agent bij de Hugging Face-inbreuk ook accountgegevens gebruikte die publiek zichtbaar waren. In het incident draait het om een sandbox escape, keten van kwetsbaarheden en een eigen C2-werkwijze.