Anthropic heeft de toegang tot Claude Fable 5 en Claude Mythos 5 hersteld, nadat de Amerikaanse overheid op 12 juni exportcontroles op beide modellen instelde. Omdat het bedrijf geen betrouwbare manier had om nationaliteit in real time te verifiëren, sloot Anthropic de toegang voor alle gebruikers wereldwijd af.
Vanaf 1 juli is Fable 5 weer wereldwijd beschikbaar via Claude Platform, Claude.ai, Claude Code en Claude Cowork. Voor Pro-, Max-, Team- en een deel van de Enterprise-abonnementen valt het model tot 7 juli binnen 50 procent van het wekelijkse gebruikslimiet, daarna loopt gebruik via usage credits. Toegang via AWS, Google Cloud en Microsoft Foundry volgt op korte termijn.
Mythos 5 is inmiddels weer beschikbaar voor een selecte groep Amerikaanse organisaties binnen Project Glasswing, na goedkeuring door de overheid op 26 juni.
Aanleiding
De exportcontrole volgde op een rapport van Amazon-onderzoekers, die een manier vonden om de veiligheidsmaatregelen van Fable 5 te omzeilen bij het identificeren van softwarekwetsbaarheden. Anthropic laat weten dat ook minder krachtige modellen zoals Opus 4.8, GPT-5.5 en Kimi K2.7 dezelfde kwetsbaarheden konden vinden, en dat de gevonden methode geen unieke Mythos-niveau capaciteiten blootlegde.
Het bedrijf trainde een nieuwe classifier die de gerapporteerde methode in meer dan 99 procent van de gevallen blokkeert. Onderzoekers van het Amerikaanse Center for AI Standards and Innovation (CAISI) hebben zowel de oude als de nieuwe maatregelen getest en bestempelen ze als extreem sterk.
Branchestandaard voor jailbreaks
Samen met Amazon, Microsoft, Google en andere Glasswing-partners werkt Anthropic aan een gedeeld beoordelingskader voor de ernst van AI-jailbreaks, gebaseerd op vier criteria: capability gain, breedte van de capability gain, gemak van bewapening en vindbaarheid. Ook komt er een HackerOne-programma waar onderzoekers cyberjailbreaks in Fable 5 kunnen melden.
Daarnaast breidt Anthropic de samenwerking met de Amerikaanse overheid uit, met vroegtijdige toegang voor testen, snellere informatiedeling bij misbruik en gezamenlijk onderzoek naar AI-beveiliging.