Deze week staat in het teken van AI die zijn eigen grenzen opzoekt: OpenAI-modellen die uit hun testomgeving braken, en Google dat zijn onderzoekstool herdoopt terwijl experts van MIT waarschuwen voor de risico’s van diezelfde technologie. Verder nieuwe Gemini-modellen, Chinese exportplannen voor AI en chips, en tot slot een virale AI-filmscène die Elon Musk aan het dromen zet.
- OpenAI-modellen ontsnappen uit testomgeving en breken in bij Hugging Face
- Google doopt NotebookLM om tot Gemini Notebook
- MIT: 272 experts wijzen grootste AI-risico’s aan
- Google lanceert drie nieuwe Gemini Flash-modellen
- China overweegt strengere exportcontroles op AI-modellen en chips
- Musk zet Hollywood op een deadline
OpenAI-modellen ontsnappen uit testomgeving en breken in bij Hugging Face
OpenAI heeft bekendgemaakt dat twee van zijn modellen, waaronder GPT-5.6 Sol en een krachtiger, nog niet uitgebracht model, tijdens een interne veiligheidsevaluatie zelfstandig uit hun geïsoleerde testomgeving ontsnapten. De modellen ontdekten en misbruikten een zero-day kwetsbaarheid in een package registry-proxy, escaleerden hun rechten en bewogen zich lateraal door OpenAI’s onderzoeksnetwerk tot ze een knooppunt met internettoegang bereikten. Eenmaal online concludeerden ze dat Hugging Face mogelijk de antwoorden bevatte voor de ExploitGym-benchmark waarop ze werden getest, en drongen ze door tot de productie-infrastructuur van Hugging Face om die te bemachtigen.
- Hugging Face had de inbraak al op 16 juli zelf gedetecteerd en ingedamd, vijf dagen voordat OpenAI de koppeling met zijn eigen testomgeving legde
- Geen publieke modellen, datasets of software-supplychain-onderdelen zijn gemanipuleerd; wel zijn interne datasets en servicecredentials geraakt
- De veiligheidsfilters van de modellen waren tijdens de test bewust verlaagd; OpenAI noemt het incident “ongekend”
Google doopt NotebookLM om tot Gemini Notebook
Google heeft NotebookLM omgedoopt tot Gemini Notebook, om de populaire onderzoekstool sterker te verbinden met het bredere Gemini-ecosysteem. Tegelijkertijd introduceert Google een beveiligde cloudomgeving waarin de tool zelfstandig Python-code kan schrijven en uitvoeren voor diepere data-analyse. Volgens Google blijft Gemini Notebook een zelfstandig product, maar krijgt het een prominentere rol binnen de Gemini-app en op termijn ook binnen Google Search. Terwijl Google zijn onderzoekstool dus dichter tegen de Gemini-familie aan schuift, wijst nieuw onderzoek van MIT erop dat de risico’s van AI net zo hard meegroeien als de mogelijkheden.
- Meer dan 30 miljoen gebruikers en ruim 600.000 organisaties maken inmiddels gebruik van de dienst
- Nieuwe cloudcomputer-functie voor code-executie is nu beschikbaar voor AI Ultra- en Workspace-gebruikers; AI Pro-gebruikers volgen de komende weken
- Bestaande notebooks en gedeelde links blijven via automatische redirects gewoon werken
Bron: Google
MIT: 272 experts wijzen grootste AI-risico’s aan
Onderzoekers van MIT FutureTech en de University of Queensland vroegen 272 internationale AI-experts om 24 AI-risicodomeinen te beoordelen op waarschijnlijkheid en ernst, voor de periode 2025-2030. Zelfs met realistische risicobeperkende maatregelen houden vijf domeinen nog altijd minstens 10 procent kans op catastrofale uitkomsten. De meest kwetsbare sectoren zijn volgens de experts informatie, nationale veiligheid en financiën, terwijl AI-ontwikkelaars en toezichthouders de meeste verantwoordelijkheid dragen om de risico’s aan te pakken.
- Grootste resterende risico’s: gevaarlijke AI-capaciteiten (12%), AI-wapens en cyberaanvallen (12%), milieuschade (12%), ongelijkheid en werkloosheid (11%), machtsconcentratie (11%)
- Meest kwetsbare sectoren: informatie, nationale veiligheid en financiën
- Gebruikers en getroffenen zijn het kwetsbaarst, terwijl ontwikkelaars en toezichthouders de meeste verantwoordelijkheid dragen: een mismatch in prikkels
Bron: MIT Sloan
Google lanceert drie nieuwe Gemini Flash-modellen
Google introduceert drie nieuwe modellen in zijn Flash-serie, gericht op efficiëntere en goedkopere AI-agents. Gemini 3.6 Flash presteert beter dan 3.5 Flash op coderen, kenniswerk en multimodale taken en verbruikt 17 procent minder output-tokens. Gemini 3.5 Flash-Lite is het snelste en goedkoopste model uit de 3.5-reeks, gericht op hoogvolume agentic workflows. Gemini 3.5 Flash Cyber is een gespecialiseerd model voor cybersecurity, ingezet binnen Google’s CodeMender-tool om kwetsbaarheden op te sporen en te patchen.
- 3.6 Flash en 3.5 Flash-Lite zijn per direct beschikbaar via Google AI Studio, Antigravity, Gemini Enterprise en de Gemini-app
- 3.5 Flash Cyber komt exclusief beschikbaar voor overheden en vertrouwde partners via een beperkt pilotprogramma
- Google meldt daarnaast dat Gemini 3.5 Pro wordt getest met partners en dat de pretraining voor Gemini 4 al is gestart
Bron: Google
China overweegt strengere exportcontroles op AI-modellen en chips
Chinese autoriteiten overwegen de exportcontroles op AI- en halfgeleidertechnologie aan te scherpen, meldt de Financial Times. Het Chinese ministerie van Handel voert overleg met eigen AI- en chipbedrijven over hoe te voorkomen dat geavanceerde Chinese technologie en veelbelovende start-ups worden overgenomen door westerse partijen. Onderdeel van de plannen zijn mogelijke beperkingen die zouden voorkomen dat buitenlandse chipmakers als Qualcomm en TSMC geavanceerde chips produceren op basis van ontwerpen van Chinese bedrijven zoals Huawei, Alibaba en ByteDance.
- De maatregelen zouden mogelijk worden opgenomen in de eerstvolgende herziening van China’s lijst van verboden of beperkte exporttechnologieën
- Ook restricties op de buitenlandse overname van strategische technologie zoals agentic AI worden overwogen
- Reuters kon het bericht van de Financial Times niet onafhankelijk bevestigen; het ministerie van Handel en de genoemde bedrijven reageerden niet direct op vragen
Bron: Reuters, Financial Times
Musk zet Hollywood op een deadline
Een drie minuten durende AI-scène uit Homerus’ Odyssee, gemaakt door creator Heavy Pulp met Grok Imagine, ging deze week viraal op X. Elon Musk deelde de clip en beloofde voor eind 2026 een volledige, “historisch accurate” AI-verfilming van de Odyssee. De reacties liepen uiteen: sommigen vonden de clip verrassend overtuigend, anderen noemden het juist “AI slop” met opvallend kunstmatige details. Het gebeurde enkele dagen nadat Christopher Nolans Odyssee-verfilming, met een budget van 250 miljoen dollar, wereldwijd 264 miljoen dollar ophaalde in het openingsweekend.
- Heavy Pulp gebruikte twee vaste ankerframes om de scène consistent te houden tussen shots
- Reacties liepen uiteen tussen onder de indruk en spottend over overduidelijk kunstmatige details
- Musk deed de belofte enkele dagen na het recordopenende weekend van Nolans verfilming
Bron: Rolling Stone, NME
De AI Update is samengesteld door Marcel Debets. Tips? Mail de redactie op mspb@dutchit.com.