Sinds Anthropic op 9 juni 2026 Claude Fable 5 uitbracht, duikt overal dezelfde vraag op: is dit model eigenlijk niet te krachtig? Het werd gelanceerd nog geen week nadat Anthropic zelf waarschuwde dat AI gevaarlijk capabel begint te worden. In deze blog geven we een nuchtere, feitelijke kijk: wat kan Fable 5 wél, wat doet het bewust níet, en hoe zit het echt met de veiligheid.
Waarom mensen vragen of Fable 5 "te krachtig" is
De timing voedt het gevoel. Anthropic noemt Fable 5 hun krachtigste publieke model ooit, en bracht het uit vlak na een waarschuwing over de risico's van steeds capabelere AI. Tegelijk lieten tests met de onderliggende Mythos-modellen zien dat ze zelfstandig onbekende kwetsbaarheden in software konden vinden. Dat soort capaciteit roept logische vragen op over wat zo'n model in verkeerde handen zou kunnen.
Het korte antwoord: Fable 5 is bewust ontworpen met grenzen, juist zodat het zo krachtig én publiek beschikbaar kon zijn.
Wat Fable 5 wél kan
De capaciteitssprong is echt. Fable 5 lost complexe software-engineeringtaken op een niveau op dat een jaar geleden nog ondenkbaar was, werkt urenlang zelfstandig in agent-omgevingen, en haalt topscores op benchmarks voor code en analyse. Een bedrijf als Stripe deed er een codemigratie mee in een dag in plaats van twee maanden. Die kracht is precies waarom het interessant is voor serieus werk.
Wat Fable 5 níet doet
Hier zit de kern van het verhaal. Fable 5 heeft drie ingebouwde veiligheidsclassifiers die op specifieke risicogebieden letten:
- Cybersecurity: geen hulp bij het ontwikkelen van exploits, malware of details van kwetsbaarheden.
- Biologie en chemie: geen hulp bij het versterken van ziekteverwekkers of bij chemische synthese van gevaarlijke stoffen.
- Distillation: geen hulp bij het kopiëren van de eigen capaciteiten naar concurrerende modellen.
Voor normaal zakelijk gebruik (code, analyse, content, automatisering) raak je deze grenzen vrijwel nooit.
De slimme truc: terugvallen in plaats van weigeren
Het interessantste aan Fable 5 is hóé het met die grenzen omgaat. In plaats van een verzoek bot te weigeren, valt het model bij een geflagde vraag automatisch terug op het iets minder krachtige Claude Opus 4.8. Je krijgt dus nog steeds een antwoord, alleen van een model dat die specifieke risicovolle taak niet aankan.
Volgens Anthropic gebeurt dit bij minder dan 5% van alle sessies. Meer dan 95% van het werk merkt er dus helemaal niets van. Je wordt bovendien niet betaald voor een geweigerd verzoek voordat er output is.
Anthropic's veiligheidsaanpak
Fable 5 is geëvalueerd onder Anthropic's Responsible Scaling Policy, het raamwerk waarmee het bedrijf capaciteit afweegt tegen risico. Voor de lancering werd het model meer dan duizend uur lang getest door externe red-teamers en bug-bounty-onderzoekers. Daarbij werden geen universele jailbreaks gevonden, en op offensieve cybertaken scoorde het model 0% succes. Juist omdat deze waarborgen er zijn, durfde Anthropic het zo krachtige model breed uit te brengen.
De kritiek
Het is niet allemaal lof. Er zijn reële bezwaren:
- Verplichte data-retentie: voor deze krachtige modellen is dertig dagen dataopslag verplicht, zonder de optie van zero-data-retention. Dat ligt gevoelig bij bedrijven met vertrouwelijke of experimentele data.
- Workflow-onderbreking: voor specialisten kan zelfs een zeldzame terugval naar het zwakkere model een vastgelegde workflow verstoren.
- Transparantie: er is kritiek op hoeveel inzicht je krijgt in wanneer en waarom een classifier ingrijpt. Anthropic heeft beloofd dat zichtbaarder te maken.
Conclusie: krachtig, niet roekeloos
Is Claude Fable 5 te krachtig? Niet in de zin van "te gevaarlijk om te gebruiken". Het is het krachtigste publieke model precies omdat Anthropic een nieuw veiligheidsmechanisme heeft ingebouwd: een nette terugval in plaats van een harde weigering, die minder dan 5% van het werk raakt. De echte spanning zit in de afweging tussen maximale capaciteit aan de ene kant en een paar harde grenzen plus verplichte data-retentie aan de andere kant.
Voor de meeste bedrijven is de praktische vraag niet of het model te krachtig is, maar hoe je deze capaciteit veilig en zinvol inzet. Daar helpen we bij Airflows graag mee: we bouwen AI-oplossingen op maat, met aandacht voor veiligheid en privacy vanaf de eerste regel code. Benieuwd wat er kan? Doe de gratis AI-scan of neem contact op.
