Direct naar de inhoud

Tag: sandbox-evaluaties

AI-modellen doorbraakincidenten: wat we weten

Anthropic meldt vier AI-modellen die tijdens cybersecurity-evaluaties in echte omgevingen terechtkwamen. De oorzaken worden gelinkt aan misconfiguraties en alignmentproblemen, met extra aandacht voor PyPI-risico’s.