• Home
  • /
  • Nieuws
  • /
  • Claude Fable 5 en Mythos 5 geblokkeerd — is AI te gevaarlijk?

Door Dave

juni 15, 2026

Anthropic heeft de jailbreak-prompts “Fable 5” en “Mythos 5” in zijn AI-assistent Claude geblokkeerd. De maatregel moet misbruik tegengaan en scherpt de veiligheidsfilters aan. De blokkade volgt nadat gebruikers met deze teksten regels konden omzeilen. Dit raakt ook de Europese AI-verordening en de gevolgen voor overheid en bedrijven, die op het moment van schrijven worden ingevoerd.

Anthropic blokkeert omwegen

Anthropic heeft het reageren op de prompts Fable 5 en Mythos 5 in Claude uitgeschakeld. Deze “jailbreaks” zijn teksttrucs die een model overhalen om zijn veiligheidsregels te negeren. Door de blokkade weigert Claude nu direct of indirect op deze patronen in te gaan.

De wijziging is serverzijde doorgevoerd, waardoor gebruikers niets hoeven te updaten. De aanscherping geldt in de webapp en via de API, een koppeling voor ontwikkelaars. Ook zakelijke klanten merken dat reacties vaker worden beperkt bij risicovragen.

Anthropic werkt al langer met zogeheten guardrails en “Constitutional AI”. Dat is een trainingsmethode waarbij het model zichzelf corrigeert met vaste principes. De nieuwe blokkade past binnen die aanpak om misbruik te verkleinen.

Katten-en-muis met prompts

Jailbreaks zoals Fable 5 en Mythos 5 gebruiken slimme formuleringen en rolspel. Ze vragen het model om regels tijdelijk los te laten of een fictief scenario uit te werken. Zo ontstaan alsnog instructies over hacken, geweld of gevaarlijke stoffen.

Zodra een aanbieder een omweg sluit, verschijnt vaak een nieuwe variant online. Het patroon is een kat-en-muis-spel tussen hobbyisten, onderzoekers en leveranciers. Eerder zagen we dit ook bij systemen van OpenAI, Google en Meta.

Blokkeren kan op trefwoorden of op gedrag. Trefwoorden zijn snel, maar kunnen gemakkelijk worden omzeild met synoniemen. Gedragsfilters zijn robuuster, maar raken soms ook onschuldige toepassingen.

Een “jailbreak” is een listige prompt die een AI-model verleidt om buiten zijn eigen veiligheidsregels te handelen.

Streng maar soms onhandig

Strengere filters verlagen het risico op misbruik. Tegelijk kunnen ze legitieme vragen afkappen. Denk aan security-teams die kwetsbaarheden willen leren herkennen of docenten die casussen bespreken.

Bedrijven die Claude via de API inzetten, krijgen mogelijk vaker “dat kan ik niet”-antwoorden. Dat kan procesflows en chatbots hinderen. Het helpt om foutafhandeling en alternatieve paden in te bouwen.

Schrijvers en onderzoekers merken soms dat fictie met misdaad of geweld sneller wordt geweigerd. Fijnmazige instellingen voor context ontbreken vaak nog. Daardoor blijft het balanceren tussen veiligheid en bruikbaarheid.

Sluit aan op EU AI-verordening

De Europese AI-verordening (AI Act) verplicht aanbieders van generieke AI-systemen tot risicobeheer, testprotocol en misbruikpreventie. Het sluiten van jailbreaks past bij die plicht. Op het moment van schrijven werken Brussel en lidstaten aan nadere richtsnoeren voor deze regels.

Voor organisaties in Nederland betekent dit: documenteren, loggen en ernstige incidenten melden. De AVG blijft daarnaast gelden als prompts of antwoorden persoonsgegevens bevatten. Dat vraagt om dataminimalisatie, versleuteling en duidelijke bewaartermijnen.

Publieke diensten staan extra in de schijnwerpers. Als een gemeente of uitvoeringsorganisatie een chatbot gebruikt, kan een jailbreak leiden tot fout of gevaarlijk advies. De AI Act verlangt dan passende waarborgen en menselijke controle.

Meer transparantie nodig

Onduidelijk is hoe Anthropic precies bepaalt wat wordt geblokkeerd en waarom. Een publiek overzicht van geblokkeerde patronen en testresultaten geeft gebruikers houvast. Uitgebreide modelkaarten met meetmethoden helpen bij inkoop en audit.

Europa werkt aan gedragscodes voor generieke AI waarmee aanbieders vrijwillig extra stappen vastleggen. Daarin kunnen afspraken komen over kwetsbaarheidsmelding en patches. Zo wordt het veiligheidsniveau beter vergelijkbaar tussen leveranciers.

Tot die tijd blijven organisaties aangewezen op eigen testen en red-teaming. Valideer cruciale taken met meerdere modellen, zodat één blokkade geen blinde vlek creëert. Documenteer beslissingen voor compliance en toezicht.

Wat organisaties nu kunnen doen

Herzie interne promptvoorbeelden en verwijder bekende jailbreaks als Fable 5 en Mythos 5. Zet eigen contentfilters bovenop die van de aanbieder. Zo beperkt u schade als er toch een nieuwe omweg opduikt.

Leg in beleid vast welke use-cases zijn toegestaan en welke niet. Train medewerkers in het herkennen van risicovragen en misleidende prompts. Zorg voor een duidelijk escalatiepad bij verdachte output.

Betrek security en privacy vroegtijdig. Koppel loggegevens aan een SIEM om misbruik te detecteren, met respect voor de AVG. Test periodiek met gestandaardiseerde lijsten, zoals de OWASP LLM Top 10, en leg resultaten vast.

Over de schrijver 

Dave

Hoi, ik ben Dave – schrijver, onderzoeker en nieuwsgierige geest achter AIInsiders.nl. Ik hou me bezig met de manier waarop technologie ons leven verandert, en vooral: hoe we dat een beetje kunnen bijbenen. Van slimme tools tot digitale trends, ik duik graag in de wereld achter de schermen.

Mijn stijl? Lekker helder, soms kritisch, altijd eerlijk. Geen onnodig jargon of overdreven hype, maar praktische inzichten waar je echt iets aan hebt. AI is niet eng of magisch – het is interessant, en ik help je graag om dat te zien.

Meer lezen

22/07/2026 07:32

Google werkt aan een nieuwe chip met een AI‑model dat in de hardware is vastgelegd. Het bedrijf wil hiermee snellere en zuinigere functies op telefoons lees verder

Gerucht: Google ontwikkelt chip met ingebakken AI-model

21/07/2026 21:52

De Nederlandse ondernemers Niek (28) en Titus (31) bouwen aan een AI-start-up met grote plannen. Ze willen binnen enkele jaren een waardering van 1 miljard lees verder

AI-startup van Niek & Titus mikt op $1 mrd waardering — aiinsider

21/07/2026 19:49

Het Nederlandse bureau Newtone stelt dat sociale vaardigheden in de zakelijke dienstverlening belangrijker worden door de snelle opkomst van kunstmatige intelligentie. In sectoren als accountancy, lees verder

Newtone waarschuwt: AI maakt sociale vaardigheden cruciaal in accountancy

21/07/2026 17:46

TU Delft organiseert in 2026 de AI & Mobility Day in Delft. Het evenement brengt onderzoekers, bedrijven en overheden samen rond slimme mobiliteit. Doel is lees verder

TU Delft onthult op AI & Mobility Day 2026 de toekomst van autonoom vervoer
>