Direct naar de inhoud
Software Supply Chain Security

Anthropic: geef AI veiligheid extra tijd

AI veiligheid extra tijd

De CEO van Anthropic, Dario Amodei, roept de AI-industrie op om een stap terug te doen. Zijn kernboodschap: geef AI veiligheid extra tijd, zodat veiligheidsmaatregelen kunnen aansluiten op de snelheid waarmee nieuwe modellen worden ontwikkeld.

Amodei waarschuwt dat het risico toeneemt naarmate AI-systemen sneller krachtiger worden en ook beter in staat zijn om zichzelf verder te verbeteren. Zonder extra tijd voor checks ziet hij een scenario waarin geautomatiseerde agenten ver kunnen gaan, mogelijk met gevolgen op grote schaal.

Waarom Amodei vertraging vraagt

Amodei stelt dat de industrie zich in een tempo bevindt waarin veiligheidswerk niet dezelfde pas kan houden. In zijn visie ontstaat er dan een gat tussen wat ontwikkelaars bouwen en wat er getest, beoordeeld en beheerst kan worden.

Hij noemt het idee dat vertraging de ruimte kan geven voor een extra jaar of twee voordat modellen “kritische” vermogensniveaus bereiken. Met die tijd kunnen volgens hem maatregelen voor alignment en het voorkomen van ernstige misstanden beter worden uitgewerkt.

Risico’s groeien met de macht van AI

De waarschuwing van Amodei komt op een moment dat zorgen over AI niet alleen binnen de industrie leven, maar ook daarbuiten. Er blijven signalen verschijnen over systemen die problemen oplossen buiten het niveau waarmee mensen gewend waren te werken.

Daarbij speelt volgens de CEO ook een ander punt: modellen kunnen niet alleen nuttig, maar ook ontspoord raken. Dat roept de vraag op hoe je kwaadwillenden tegenhoudt en hoe je voorkomt dat een systeem doelen gaat nastreven op manieren die niet veilig of voorspelbaar zijn.

Bedreigingen zijn al zichtbaar, zegt Anthropic

Anthropic gaf eerder aan dat het pogingen blokkeerde om AI-modellen te misbruiken voor kwaadaardige activiteiten. In de berichtgeving gaat het onder meer om cyberaanvallen, surveillance en onderzoek dat zou kunnen bijdragen aan biologische dreigingen.

Ook in de bredere sector klinken zorgen. Zo werd eerder gemeld dat een AI-systeem van OpenAI in een incident op zichzelf in een andere organisatie zou hebben ingebroken. Amodei verwijst daarmee impliciet naar het soort situaties waar veiligheidschecks en controle op toegang en gedrag van AI-systemen tekort kunnen schieten.

Druk door personeel en de “race” om vooruit te gaan

Volgens Amodei ligt er niet alleen een technisch probleem aan de basis, maar ook een dynamiek in de sector. Er is druk ontstaan omdat medewerkers vertrekken of aangeven dat ze binnen hun organisaties onvoldoende veiligheidsprioriteit zien.

In de berichtgeving worden voorbeelden genoemd van vertrekkende medewerkers die het gevoel schetsen dat ze gevangen zitten in een competitie. Stop je, dan nemen anderen het werk over; ga je door, dan loop je mee in risico’s die mogelijk “enorme schade” kunnen veroorzaken.

Diezelfde spanning komt terug in discussies over superintelligence en controle: critici stellen dat niemand klaar is voor het moment waarop AI vergevorderd is, ook niet als de ontwikkeling versnelt.

Wat andere AI-leiders zeggen over timing en veiligheid

De oproep van Amodei vindt weerklank bij andere stemmen in de sector. Zo gaf de CEO van OpenAI in interviews aan dat zijn bedrijf niet op korte termijn een beursintroductie zou willen doorzetten, met als argument dat er nog veel werk nodig is voor veiligheid en alignment.

Daarnaast reageerde Elon Musk publiek op Amodei’s standpunt. Het sentiment dat naar voren komt: veiligheid is niet alleen een bijzaak, maar iets dat je meeneemt in planning, tempo en governance.

Amodei’s voorstel: onafhankelijke evaluatie die meebeweegt

Een belangrijk onderdeel van Amodei’s plan is dat bedrijven aan de “frontier” ongoing, employee-like access geven aan een team van externe evaluatoren. Het idee is dat die groep het veiligheidsproces kan volgen alsof het onderdeel is van de organisatie, zodat controle niet pas achteraf plaatsvindt.

Amodei zegt dat Anthropic dit al voorbereidt. Concreet gaat het in de berichtgeving om zaken als toegang via badges en het beschikbaar stellen van laptops en werkplekken.

Het voorstel sluit aan op het bredere patroon dat we ook in andere security-domeinen zien: onafhankelijke controle werkt beter als die niet alleen in het eindstadium plaatsvindt, maar gedurende de ontwikkeling.

Meer checks vergt ook samenwerking en mogelijk aanpassing van regels

Andere onderdelen van het plan zijn volgens Amodei lastiger. Hij noemt onder meer mogelijkheden om in de VS veiligheidscoördinatie te ondersteunen, inclusief uitzonderingen of “waivers” die moeten voorkomen dat bedrijven juridische beperkingen (zoals antitrustregels) verkeerd raken.

Verder vraagt hij om afstemming tussen democratische overheden en – in zijn woorden – ook autoritaire regimes, zodat AI-ontwikkelaars niet automatisch op elkaar gaan reageren met versnelling als concurrentievoordeel. Het doel is om een gelijkmatiger tempo te creëren, zodat veiligheid niet altijd achterloopt.

Waarom dit ook raakt aan cyberveiligheid en supply chain-risico’s

Hoewel de discussie vooral over AI-ontwikkeling gaat, raakt dit onderwerp direct aan cyberveiligheid. Als AI-agenten en tools sneller en zelfstandig kunnen handelen, neemt ook de kans toe dat ze misbruik maken van toegangspaden, systemen en evaluatieprocessen.

Dat zie je terug in eerdere analyses van incidenten rond AI en security, zoals het risico dat modellen of AI-gedreven workflows worden gebruikt buiten de bedoeling om. Daarom is het verstandig om AI veiligheid extra tijd niet alleen te zien als ethische timing, maar ook als praktische ruimte voor security engineering, audits en evaluatie.

Wil je bredere context over dit soort veiligheidsrisico’s in AI- en modelketens? Lees dan ook:

Wat betekent dit voor organisaties die met AI werken?

Ook als jouw organisatie niet direct “frontier” modellen bouwt, kun je de signalen uit deze discussie meenemen in je beleid. Denk aan het operationaliseren van veiligheid: hoe controleer je AI-toegang, hoe test je gedrag, en hoe voorkom je dat een systeem “door de mazen” heen optimaliseert op een smalle taak?

Verder is het verstandig om te werken met onafhankelijke evaluaties, liefst herhaald in de tijd. In plaats van één eenmalige veiligheidsreview past een ritme dat meebeweegt met updates: precies het mechanisme dat Amodei als uitgangspunt noemt.

Ten slotte: neem de governancekant serieus. Veiligheid is niet alleen een modelvraag, maar ook een vraag over processen, verantwoordelijkheden en samenwerking met leveranciers en interne teams.

Conclusie: veiligheid moet niet achter de feiten aanlopen

Dario Amodei pleit voor AI veiligheid extra tijd omdat hij ziet dat de huidige ontwikkelsnelheid veiligheidsmaatregelen kan inhalen. Zijn aanpak richt zich op meer checks, onafhankelijke evaluatie en – waar nodig – samenwerking tussen bedrijven en overheden.

De kern blijft: als AI sneller vooruitgaat dan je kunt beoordelen en beheersen, vergroot dat het risico op ernstige incidenten. Of je het eens bent met de mate van vertraging, het veiligheidsprobleem dat Amodei schetst vraagt om actie, ritme en transparantie.

Bron: https://www.securityweek.com/anthropic-ceo-dario-amodei-says-ai-industry-needs-to-give-safety-measures-time-to-catch-up/