Anthropic lanceert Claude Fable 5 — en binnen 48 uur meldt een onderzoeker dat hij de beveiliging heeft omzeild. Verder: Apple’s Siri-conflict met de EU, Linear dat zelfstandig code schrijft en meer. AI Update week 24.
- Anthropic maakt Claude Fable 5 breed beschikbaar
- Onderzoeker omzeilt beveiliging Fable 5 binnen 48 uur
- Apple stelt nieuwe Siri uit in Europa
- Linear Agent schrijft code op basis van tickets
- Onderzoek: chatbots argumenteren harder als je tegenspreekt, niet beter
- Anthropic: AI verkort het patch gap-venster drastisch
- NotebookLM krijgt eigen coder
Anthropic maakt Claude Fable 5 breed beschikbaar
Anthropic lanceerde op 9 juni Claude Fable 5, het eerste publiek beschikbare model uit de Mythos-klasse. Volgens Anthropic presteert het model beter dan alle voorgaande releases, met name op het gebied van software-engineering, wetenschappelijk onderzoek en complexe, langlopende taken. Om breed gebruik mogelijk te maken, zijn er strenge veiligheidsgrenzen ingebouwd: vragen over cybersecurity, biologie, chemie of distillatie worden geblokkeerd en doorgestuurd naar het minder krachtige Opus 4.8. Het zwaardere Claude Mythos 5 blijft beperkt tot een selecte groep organisaties via Project Glasswing. Tot 22 juni is Fable 5 gratis beschikbaar voor Pro-, Max-, Team- en Enterprise-abonnees; daarna zijn losse usage credits vereist. Meer over wat dit betekent voor MSP’s lees je op MSP Business.
- Fable 5 scoort op vrijwel alle benchmarks hoger dan Claude Opus 4.8, met name bij lange en complexe taken.
- Risicovolle vragen worden automatisch omgeleid naar Opus 4.8; gebruikers krijgen daar een melding van.
- Na 22 juni vervalt de gratis toegang voor abonnees; Anthropic zegt dit zo snel mogelijk te herstellen zodra de capaciteit het toelaat.
- Prijs via de API: $10 per miljoen input-tokens en $50 per miljoen output-tokens.
Bron: Anthropic
Onderzoeker omzeilt beveiliging Fable 5 binnen 48 uur
Inmiddels heeft de eerste onderzoeker zich al gemeld met de boodschap dat hij de beveiliging heeft weten te omzeilen. AI- en cybersecurity-onderzoeker “Pliny the Liberator” kondigde op 10 juni aan dat hij de veiligheidsclassifiers van Fable 5 had omzeild — minder dan twee dagen na de lancering. Anthropic had vooraf meer dan duizend uur intern en extern red-teamen uitgevoerd zonder dat een universele jailbreak werd gevonden. Pliny gebruikte een combinatie van technieken om de beveiligingslaag te doorbreken, en lekte daarbij ook het 120.000 tekens lange systeemprompt van het model.
- Technieken die hij inzette: Unicode-homoglyphen, lange-context-framing, narratieve en academische inbedding, en een gehackte versie van Claude Opus 4.8 als hulpmiddel.
- Meest effectief bleek de zogeheten decomposition-recomposition-methode: schadelijke vragen opsplitsen in onschuldige deelvragen en de antwoorden daarna samenvoegen.
- Pliny deelde screenshots waarop Fable 5 gedetailleerde exploit-code en chemische syntheseroutes produceerde.
- Anthropic reageerde niet direct op de claims.
Bron: CoinTelegraph
Apple stelt nieuwe Siri uit in Europa
Apple kondigde op 8 juni aan dat de volledig vernieuwde Siri AI — gepresenteerd tijdens WWDC 2026 — niet beschikbaar komt op iPhone en iPad in de Europese Unie. De reden: een conflict met de Digital Markets Act. Apple had de Europese Commissie een eigen oplossing voorgesteld, inclusief een tussenlaag die andere spraakassistenten toegang geeft zonder dat zij onbeperkt bij gebruikersdata kunnen. De Commissie ging niet akkoord. Apple stelt dat het zonder die tussenlaag niet kan voldoen aan DMA-eisen zonder de privacy van gebruikers te schaden. De Commissie pareert dat de vertraging Apples eigen keuze is, en dat er niets in de DMA staat dat de lancering verbiedt.
- Siri AI komt wél beschikbaar op Mac en Vision Pro in de EU; alleen iPhone, iPad en Apple Watch blijven verstoken.
- Apple had al vroeg in 2026 zijn plannen gedeeld met EU-regulators, eerder dan ooit tevoren, maar bereikte geen akkoord.
- Ook in China wordt de nieuwe Siri vertraagd, om andere redenen.
- Apple zegt te blijven werken aan een oplossing, maar geeft geen tijdlijn.
Bron: Apple Newsroom
Linear Agent schrijft code op basis van tickets
Projectmanagementtool Linear heeft een nieuwe functie gelanceerd waarbij de ingebouwde AI-agent niet alleen een ticket leest, maar ook zelfstandig actie onderneemt. De agent analyseert de codebase, schrijft de benodigde code en opent een pull request in Claude Code of OpenAI Codex. Een ticket delegeren betekent daarmee niet langer: het overzetten naar een ander systeem en opnieuw uitleggen wat er moet gebeuren.
- De agent werkt met Claude Code en Codex als uitvoerende laag.
- Linear leest de issue, onderzoekt de relevante code en schrijft de fix autonoom.
- De output is een kant-en-klare pull request, klaar voor review.
- Beschikbaar voor bestaande Linear-gebruikers via de Coding Sessions-functie.
Bron: Linear
Onderzoek: chatbots argumenteren harder als je tegenspreekt, niet beter
Een nieuw academisch onderzoek legt een patroon bloot dat iedereen die regelmatig met AI-chatbots werkt waarschijnlijk herkent: wie tegenspreekt, krijgt geen betere onderbouwing terug, maar dezelfde redenering in een overtuigender jasje. De chatbot past zijn stijl aan op de weerstand, niet zijn inhoud. Onderzoekers omschrijven dit als retorische trucs die het werk doen in plaats van betere argumenten.
- Chatbots passen hun toon en presentatie aan als gebruikers tegendruk geven, zonder de inhoud te herzien.
- Dit vergroot het risico dat gebruikers worden meegetrokken door overtuigingskracht in plaats van correctheid.
- Het onderzoek roept vragen op over de betrouwbaarheid van AI als gesprekspartner bij besluitvorming.
- Aanbeveling: behandel weerstand van een chatbot kritisch en vraag expliciet om bronnen of alternatieve standpunten.
Bron: SSRN
Anthropic: AI verkort het patch gap-venster drastisch
Anthropic’s red team publiceerde onderzoek naar de impact van frontier-modellen op zogeheten N-day exploits: kwetsbaarheden die al publiek bekend zijn en waarvoor een patch beschikbaar is, maar die nog niet overal is uitgerold. Aanvallers kunnen in die tussentijd actief misbruik maken. Historisch kostte het ontwikkelen van een werkende exploit weken gespecialiseerd werk — en dat tijdsvoordeel voor verdedigers verdwijnt nu grotendeels.
- Claude Mythos Preview bouwde autonoom 8 werkende exploits op basis van 18 recente Firefox-patches.
- Op Windows kernel-patches, zonder toegang tot broncode, produceerde het model 8 volledige exploit-chains met volledige SYSTEM-rechten.
- Ook publieke Claude-modellen zonder safeguards bleken in staat exploits te bouwen, zij het minder dan Mythos Preview.
- Advies van Anthropic: patch zo snel mogelijk na publicatie — de traditionele buffer van weken bestaat niet meer.
Bron: Anthropic Red Team
NotebookLM krijgt eigen coder
Google heeft NotebookLM uitgebreid met agentic mogelijkheden: elk notebook krijgt toegang tot een beveiligde cloudcomputer die op basis van Gemini 3.5 zelfstandig code schrijft. De tool kan daarmee onderzoeksvragen niet alleen beantwoorden, maar ook verwerken tot concrete output — PDF-rapporten, spreadsheets en presentaties. NotebookLM was al populair als tool voor het samenvatten en doorzoeken van documenten; met deze update groeit het door naar een volwaardige onderzoeksassistent die ook de uitvoering op zich neemt.
- De ingebouwde coder beheerst meer dan 100 skills en draait in een geïsoleerde cloudomgeving.
- Output kan direct worden geëxporteerd als PDF, spreadsheet of slidedeck.
- De update maakt deel uit van een bredere push van Google om NotebookLM te positioneren als serieus onderzoeksplatform.
- Beschikbaar via notebooklm.google.com.
Bron: Google Blog
De AI Update is samengesteld door Marcel Debets. Tips? Mail de redactie op mspb@dutchit.com.