
Anthropic verbergt gevaarlijk AI-model bewust voor publiek: ‘Te krachtig’
Een AI-model dat beveiligingslekken opspoort klinkt nuttig. Maar wat als datzelfde model ook de aanval kan uitvoeren? Anthropic staat voor precies dat dilemma met zijn nieuwste creatie, Claude Mythos. Het techbedrijf koos bewust voor geheimhouding, omdat de mogelijkheden te gevaarlijk zijn voor breed publiek gebruik.
Een model met twee gezichten
Claude Mythos is het nieuwste AI-model van Anthropic, het Amerikaanse bedrijf achter de bekende Claude-assistent. Het model richt zich specifiek op cyberveiligheid. Dat klinkt op het eerste gezicht positief: organisaties kunnen zo sneller kwetsbaarheden in hun systemen opsporen. Echter, dezelfde technologie die beveiligingslekken vindt, kan ook worden ingezet om exploits te ontwikkelen. Dat zijn gereedschappen waarmee hackers systemen actief kunnen binnendringen.
Daarmee begeeft Anthropic zich op een gevaarlijk kruispunt. Het bedrijf heeft een instrument gecreëerd dat zowel verdedigt als aanvalt. Bovendien is de grens tussen die twee functies flinterdun. Wie toegang heeft tot Claude Mythos, beschikt dus in theorie over een krachtige tool voor zowel bescherming als digitale sabotage. Dat maakt de vraag wie het model mag gebruiken uiterst gevoelig.
Beperkte toegang als veiligheidsmaatregel
Om misbruik te voorkomen, koos Anthropic voor een strenge toelatingspolitiek. Voorlopig deelt het bedrijf uitsluitend een proefversie van Claude Mythos met een selecte groep grote techbedrijven. Welke bedrijven precies toegang hebben gekregen, heeft Anthropic niet bekendgemaakt. Dat gegeven op zichzelf illustreert hoe voorzichtig het bedrijf omgaat met dit model.
Het besluit om de toegang te beperken is niet zomaar een zakelijke keuze. Anthropic geeft expliciet aan dat het model als te krachtig wordt beschouwd om zomaar vrij te geven. Die formulering, namelijk dat iets in verkeerde handen kan vallen, wijst op een bewuste risicoafweging. Daarmee plaatst het bedrijf zichzelf in een bijzondere positie: het erkent openlijk dat het iets heeft gebouwd met een potentieel destructief karakter.
Cyberveiligheid als dubbel zwaard
De discussie rond Claude Mythos raakt aan een bredere spanning binnen de wereld van cyberveiligheid. Beveiligingsonderzoekers werken al jaren met zogenoemde offensive security tools: programma’s die aanvalstechnieken simuleren om verdedigingen te testen. Dergelijke tools zijn in professionele handen waardevol. Daarnaast vormen ze in verkeerde handen een serieuze dreiging.
Wat Claude Mythos anders maakt, is de schaal en de toegankelijkheid die AI biedt. Traditionele beveiligingstools vereisen diepgaande technische kennis. Een AI-model als dit kan die drempel drastisch verlagen. Iemand zonder uitgebreide technische achtergrond kan mogelijk toch complexe aanvallen uitvoeren, simpelweg door de juiste vragen te stellen aan het model. Dat maakt de keuze van Anthropic om toegang te beperken begrijpelijk, maar roept ook vragen op.
Wat betekent dit voor de techsector
De introductie van Claude Mythos zet de rest van de techsector voor een spiegel. Grote spelers als Google, Microsoft en anderen bouwen eveneens aan AI-tools voor cyberveiligheid. De vraag is hoe zij omgaan met vergelijkbare ethische kwesties. Anthropic kiest nu openlijk voor transparantie over de risico’s, ook al leidt dat tot beperkte beschikbaarheid. Dat is een opvallende stap in een sector die zulke beperkingen zelden vrijwillig oplegt.
Bovendien signaleert dit besluit iets belangrijks over de toekomst van AI-ontwikkeling. Bedrijven kunnen steeds vaker niet meer volstaan met het simpelweg lanceren van een product. De maatschappelijke verantwoordelijkheid groeit mee met de kracht van de technologie. Anthropic laat daarmee zien dat het zich bewust is van die verantwoordelijkheid, al blijft de vraag of beperkte toegang op lange termijn voldoende is als maatregel.
Risico’s van halfopen deuren
Toch zijn er kanttekeningen bij de aanpak van Anthropic. Een model dat gedeeld wordt met grote techbedrijven, is niet volledig verborgen. Hoe robuust is de screening van die bedrijven? Bovendien bestaat het risico dat vergelijkbare technologie elders, ook bij minder voorzichtige partijen, in ontwikkeling is. Restricties van één bedrijf houden de wereld niet tegen.
Cybersecurity-experts wijzen al langer op dit fenomeen: als de technologie bestaat, verspreidt ze zich. Daarom pleiten velen voor internationale afspraken over de ontwikkeling en het gebruik van krachtige AI-modellen op het gebied van cyberveiligheid. Echter, zulke afspraken zijn complex en komen langzaam tot stand. Tot die tijd vertrouwt de sector op de zelfregulering van individuele bedrijven, zoals Anthropic nu doet.
Volgende stappen voor Claude Mythos
Anthropic heeft vooralsnog niet aangegeven wanneer of onder welke voorwaarden Claude Mythos breder beschikbaar komt. De proeffase met grote techbedrijven dient vermoedelijk om de werking van het model te testen en tegelijk de risico’s nauwkeurig in kaart te brengen. Daarna kan het bedrijf beslissen of bredere toegang verantwoord is, en zo ja, onder welke strikte condities. Tot die tijd blijft Claude Mythos wat het nu is: een krachtig instrument achter een gesloten deur, bewust uit het zicht gehouden om de veiligheid van het publiek te beschermen.
Bronnen: NU.nl, RTL Nieuws





