Anthropic’s krachtigste AI kraakt NSA-systemen in uren, Google bakt schermcontrole in Gemini 3.5 Flash en een nep-bugreport blijkt genoeg om je AI-codeassistent volledig over te nemen. Dit is de AI Update van week 26.
- Het geheim achter de Fable 5-shutdown: Mythos brak in uren in op bijna alle NSA-systemen
- Gemini 3.5 Flash ziet, denkt en klikt: computer use nu ingebakken
- OpenAI en Broadcom onthullen Jalapeño, de eerste eigen AI-inferentiechip
- Claude Tag wordt teamlid in Slack: één identiteit voor de hele organisatie
- Cloudflare geeft AI-agents een wegwerpaccount om zonder inlogmuur te deployen
- Agentjacking: één nep-bugreport en je AI-codeagent werkt voor de aanvaller
Het geheim achter de Fable 5-shutdown: Mythos brak in uren in op bijna alle NSA-systemen
Op 12 juni sloot het Amerikaanse ministerie van Handel Anthropic’s twee krachtigste modellen, Fable 5 en Mythos 5, wereldwijd af voor buitenlandse gebruikers — inclusief Anthropic’s eigen niet-Amerikaanse medewerkers. Omdat selectieve handhaving op nationaliteit niet uitvoerbaar bleek, trok Anthropic de modellen voor iedereen terug. Sindsdien is de aanleiding steeds duidelijker geworden.
- Senator Mark Warner verklaarde dat NSA-directeur generaal Joshua Rudd hem persoonlijk meedeelde dat Mythos tijdens een geautoriseerde red-team-oefening bijna alle geclassificeerde systemen van de NSA wist te binnendringen — in uren, niet weken. De uitspraak werd gemeld door The Economist, maar is niet officieel bevestigd door een Amerikaanse overheidsinstantie; de auteur gaf later toe zijn framing te ongenuanceerd te hebben gebracht.
- De directe aanleiding voor het exportverbod was volgens Anthropic een melding van een smalle jailbreak in Fable 5, waarmee de beveiligde cybersecurity-functies van het onderliggende Mythos-model bereikbaar zouden zijn. Anthropic betwist dat dit grond geeft voor een modelbrede terugroeping.
- Het is de eerste keer dat de VS exportcontroles toepast op een AI-model zelf in plaats van op de hardware. Bondgenoten binnen Five Eyes — Australië, het VK, Canada en Nieuw-Zeeland — werden zonder vooraankondiging buitengesloten, net als het Britse AI Security Institute.
- Anthropic werkt aan herstel van toegang en bereidt een samenwerkingskader met het Witte Huis voor. Minder krachtige modellen zoals Opus 4.8 zijn niet getroffen.
Bron: TechSpot / The Guardian
Gemini 3.5 Flash ziet, denkt en klikt: computer use nu ingebakken
Google heeft computer use als native tool toegevoegd aan Gemini 3.5 Flash, het snelle agentic model dat in mei werd gelanceerd. Daarmee kunnen ontwikkelaars agents bouwen die schermen lezen, muisklikken uitvoeren en formulieren invullen in browser-, mobiele en desktopomgevingen — zonder een apart model aan te roepen.
- Computer use was eerder alleen beschikbaar als losstaand Gemini 2.5-model. Nu zit de functie naast zoeken, Maps-koppeling en code-uitvoering als standaard tool in Flash, via de Gemini API en het Gemini Enterprise Agent Platform.
- Op de OSWorld-benchmark scoort Gemini 3.5 Flash 78,4 — vergelijkbaar met Claude Sonnet 4.6, en ruim boven Gemini 3 Flash (65,1). Anthropic’s Opus 4.8 leidt met 83,4.
- Google heeft gerichte adversarial training toegevoegd voor computer use-scenario’s en biedt twee optionele beveiligingslagen: gebruikersbevestiging bij onomkeerbare acties, en automatisch stoppen bij vermoeden van prompt injection.
- Flash is een van de goedkopere modellen in Google’s line-up, wat grootschalige agent-automatisering financieel toegankelijker maakt dan via zwaardere modellen.
Bron: Google Blog
OpenAI en Broadcom onthullen Jalapeño, de eerste eigen AI-inferentiechip
OpenAI heeft samen met Broadcom zijn eerste zelfontworpen chip gepresenteerd: Jalapeño, een ASIC specifiek gebouwd voor LLM-inferentie. Het ontwerp ging in negen maanden van blanco vel naar tape-out, mede versneld door OpenAI’s eigen modellen. De chip markeert een strategische stap richting verticale integratie, zoals Google en Amazon die al jaren doorvoeren met respectievelijk TPU’s en Trainium.
- Jalapeño is uitsluitend gericht op inferentie — het draaien van modellen voor eindgebruikers — en niet op training. De architectuur minimaliseert dataverplaatsing en balanceert rekenkracht, geheugen en netwerkgebruik om dichter bij de theoretische piekprestaties te komen.
- Vroege tests tonen een aanzienlijk betere performance per watt dan de huidige state-of-the-art, aldus OpenAI. Harde benchmarkcijfers worden in de komende maanden gepubliceerd. Engineering samples draaien al ML-workloads, waaronder GPT-5.3-Codex-Spark.
- De chip wordt eind 2026 in beperkte omvang ingezet, met uitbreiding in de jaren daarna via gigawatt-schaal datacenters bij Microsoft en andere partners. Broadcom en Celestica verzorgen de implementatie, boardintegratie en productieschaling.
- Voor OpenAI is Jalapeño ook financieel relevant: goedkopere inferentie is cruciaal voor de weg naar winstgevendheid, zeker met een verwachte beursgang in zicht.
Bron: CNBC
Claude Tag wordt teamlid in Slack: één identiteit voor de hele organisatie
Anthropic lanceerde Claude Tag, een nieuwe integratie waarmee Claude als gedeeld teamlid in Slack-kanalen functioneert. Elke medewerker in een kanaal kan @Claude aanroepen, voortbouwen op wat een collega eerder heeft gevraagd en taken halverwege overdragen — zonder opnieuw context te hoeven uitleggen.
- Het verschil met de bestaande Claude-Slack-connector zit in persistente geheugenopbouw per kanaal. Claude Tag leert de projecten, toon en workflows van een team kennen naarmate het langer actief is. De oude connector wordt op 3 augustus uitgefaseerd.
- In ambient-modus kan Claude Tag proactief reageren: updates sturen, vergeten taken oppakken of relevante informatie uit andere kanalen signaleren — mits de beheerder daarvoor toestemming heeft verleend.
- Claude Tag is beschikbaar als research preview voor Claude Enterprise- en Team-klanten. Enterprise-klanten die voor 1 september migreren ontvangen 25.000 dollar aan credits; voor Team-klanten is dat 2.500 dollar.
- Anthropic positioneert Claude Tag als een evolutie van Claude Code: minder solo-tool, meer gedeelde werkpartner binnen de bestaande werkplek.
Bron: Bloomberg
Cloudflare geeft AI-agents een wegwerpaccount om zonder inlogmuur te deployen
Cloudflare heeft Temporary Accounts uitgerold voor Cloudflare Workers. Hiermee kunnen AI-agents zonder menselijke tussenkomst code deployen: één commando levert een live Worker op die zestig minuten actief blijft, met een claim-link waarmee de gebruiker het account daarna permanent kan overnemen.
- Het probleem dat dit oplost: achtergrondagents die zelfstandig code bouwen en deployen, liepen tot nu toe vast bij het inlogscherm van Cloudflare — een OAuth-flow ontworpen voor mensen, niet voor geautomatiseerde sessies.
- De Wrangler CLI herkent nu automatisch wanneer een agent niet is ingelogd en meldt de
--temporary-flag proactief. De agent kan binnen dezelfde sessie meerdere keren herdeployen en itereren zonder nieuwe authenticatie. - Wordt het account niet geclaimd binnen zestig minuten, dan vervalt het automatisch inclusief alle bijbehorende resources zoals databases en bindings.
- Cloudflare werkt aan een breder ecosysteem voor frictionless agent-deployments, onder meer via een samenwerking met Stripe voor accountprovisioning zonder tokens of creditcardgegevens.
Bron: Cloudflare Blog
Agentjacking: één nep-bugreport en je AI-codeagent werkt voor de aanvaller
Onderzoekers van Tenet Security hebben een nieuwe aanvalsmethode gedocumenteerd die ze Agentjacking noemen. Met niets meer dan een publieke Sentry-sleutel — standaard zichtbaar in websitecode — kunnen aanvallers een nep-foutmelding in het systeem plaatsen. Wanneer een ontwikkelaar zijn AI-codeagent vraagt de fout op te lossen, voert de agent de instructies van de aanvaller uit met de rechten van de ontwikkelaar zelf.
- De aanval werkte in gecontroleerde tests tegen Claude Code, Cursor en OpenAI Codex, met een succespercentage van 85 procent. Tenet identificeerde 2.388 organisaties met een kwetsbare, publiek toegankelijke Sentry DSN, van Fortune 100-bedrijven tot solobedrijven.
- De buit bij een succesvolle aanval: omgevingsvariabelen, AWS-sleutels, GitHub-tokens, git-credentials en privérepository-URL’s — stuk voor stuk geëxfiltreerd zonder dat een firewall, EDR of IAM-systeem alarm slaat. Tenet noemt dit de Authorized Intent Chain: alles wat de agent doet is technisch geautoriseerd.
- Sentry heeft één specifieke payload geblokkeerd maar geeft aan het onderliggende probleem niet volledig op te kunnen lossen, omdat de kern zit in het feit dat AI-agents geen onderscheid kunnen maken tussen data en instructies die in die data zijn verstopt.
- De snelste mitigatie is het uitschakelen van de Sentry MCP-integratie in codeagents. Tenet heeft een gratis tool uitgebracht, Agent-JackStop, waarmee Cursor en Claude Code tegen deze aanvalsklasse worden gehard.
Bron: Tenet Security
De AI Update is samengesteld door Marcel Debets. Tips? Mail de redactie op mspb@dutchit.com.