Deze week: Nvidia neemt Hugging Face over voor 12,9 miljard dollar, Apple’s nieuwe M6 en M5 Ultra tillen on-device AI naar een hoger niveau, Perplexity brengt de volledige AI-agentstack naar lokale hardware met Portable Computer, Nvidia’s Groq 3 LPX gaat in volledige productie en verlaagt de kosten van tokengeneratie drastisch, OpenAI lanceert ChatGPT Ads in 31 Europese landen, en Pew Research becijfert dat een derde van alle webpagina’s sinds de release van ChatGPT tekenen van AI-auteurschap vertoont.
- Nvidia neemt Hugging Face over voor 12,9 miljard dollar
- Apple M6 en M5 Ultra tillen on-device AI naar hoger niveau
- Perplexity brengt AI-agents naar lokale hardware met Portable Computer
- Nvidia’s Groq 3 LPX in volledige productie voor razendsnelle tokengeneratie
- OpenAI lanceert ChatGPT Ads in 31 Europese landen
- Een derde van het web sinds ChatGPT is door AI geschreven
Nvidia neemt Hugging Face over voor 12,9 miljard dollar
Nvidia heeft naar verluidt ingestemd met de overname van Hugging Face, het grootste open-source platform voor AI-modellen, voor 12,9 miljard dollar. Het nieuws werd als eerste gemeld door The Information.
- Hugging Face host bijna 3 miljoen publieke modelrepositories, 1 miljoen datasets en 1,44 miljoen Spaces, en draait momenteel op 150 miljoen dollar aan jaarlijkse omzet.
- Het bedrijf wees vorig jaar nog een investering van 500 miljoen dollar van Nvidia af bij een waardering van 7 miljard dollar, met als reden dat het de community wilde beschermen tegen te veel invloed van één partij.
- De overname zou Nvidia een stevige voet tussen de deur geven in het open-source AI-ecosysteem, op een moment dat klanten als OpenAI, Google, Amazon en Anthropic zelf chips ontwikkelen om minder afhankelijk te worden van Nvidia-hardware.
- De deal moet in de eerste helft van 2027 worden afgerond, in afwachting van mededingingstoetsing.
Bron: TechCrunch
Apple M6 en M5 Ultra tillen on-device AI naar hoger niveau
Apple heeft de M6-chip en de M5 Ultra officieel aangekondigd, respectievelijk in een nieuwe Mac mini en Mac Studio. Beide chips leggen de nadruk op AI-verwerking rechtstreeks op het apparaat.
- M6 is Apple’s eerste chip op een 2nm-procédé, met een 12-core CPU (twee super cores, vier performance cores, zes efficiency cores), een 12-core GPU met een Neural Accelerator per core, en een Dual 16-core Neural Engine.
- Volgens Apple levert de nieuwe GPU-architectuur bijna 30 procent meer piekcompute voor AI op dan de M5, en ruim 8 keer zoveel als de M1, wat zorgt voor snellere promptverwerking bij taalmodellen die lokaal draaien.
- M5 Ultra combineert twee M5 Max-chips via Apple’s UltraFusion-techniek tot een quad-die-architectuur, met een 32-core Neural Engine, tot 512GB unified memory en 1,2TB/s geheugenbandbreedte.
- Die geheugencapaciteit maakt het volgens Apple mogelijk om taalmodellen met honderden miljarden parameters volledig op het apparaat te draaien, zonder cloudverbinding.
- De Mac mini met M6 is beschikbaar vanaf 22 september; de Mac Studio met M5 Ultra is vanaf nu te bestellen, met configuraties van 512GB die pas eind oktober leverbaar zijn.
Bron: MacRumors
Perplexity brengt AI-agents naar lokale hardware met Portable Computer
Perplexity introduceert Portable Computer, een systeem dat de volledige agentstack (harness, orchestrator en getrainde modellen) lokaal laat draaien op de NVIDIA DGX Spark, in plaats van in de cloud.
- Taken lopen standaard lokaal via het model Qwen 3.8 27B; NVIDIA Nemotron 3.5 Lightning volgt later als extra optie.
- Alleen wanneer een taak diepere reasoning of actuele webinformatie vereist, vraagt de orchestrator eerst toestemming voordat die stap naar een van de meer dan vijftien cloudmodellen gaat, waaronder GPT-5.5 en Claude Fable 5.
- Code en tool-uitvoering draaien in geïsoleerde sandboxes met beperkte toegang tot lokale bestanden en gekoppelde apps zoals Gmail, Outlook, Slack en GitHub.
- Werk dat door de lokale modellen wordt afgehandeld, kost geen tokens, wat volgens Perplexity grootschalige klussen zoals repository-migraties of het samenvatten van lokale bestandensets praktisch maakt.
- Portable Computer vereist een DGX Spark met GB10-chip, 128GB geheugen en minimaal 1TB opslag, en is nu beschikbaar voor Pro- en Max-abonnees.
Bron: Perplexity
Nvidia’s Groq 3 LPX in volledige productie voor razendsnelle tokengeneratie
Nvidia heeft op Hot Chips 2026 aangekondigd dat de Groq 3 LPX, het eerste chip dat voortkomt uit de overname van Groq voor 20 miljard dollar, in volledige productie is. De chip is uitsluitend gericht op snellere tokengeneratie.
- Een onafhankelijke benchmark van Artificial Analysis mat 3.431 output tokens per seconde op een Gemma 4 31B-workload met een context van 100.000 tokens, ruim vier keer zo snel als het op één na snelste publieke endpoint.
- Om dat resultaat te behalen zijn minimaal 64 accelerators nodig, terwijl concurrent Cerebras met één of twee accelerators een vergelijkbare snelheid haalt, wat de vergelijking in Nvidia’s voordeel laat uitvallen.
- Nebius is de eerste cloudprovider die de chip via Nebius Token Factory in productie neemt; Groq zelf staat als vroege adopter op de lijst.
- De Groq 3 LPX is een uitbreiding op het Vera Rubin-platform en ondersteunt racks met tot 256 LP30-accelerators, gekoppeld via hoge-bandbreedte-interconnects.
Bron: Tom’s Hardware
OpenAI lanceert ChatGPT Ads in 31 Europese landen
OpenAI heeft ChatGPT Ads beschikbaar gemaakt in 31 Europese landen, waaronder alle EU-lidstaten aangevuld met Noorwegen, IJsland, Liechtenstein en Zwitserland. Het is de grootste uitbreiding van het advertentieplatform tot nu toe.
- Advertenties zijn alleen zichtbaar voor gebruikers van ChatGPT Free en Go; Plus, Pro, Business, Enterprise en Edu blijven advertentievrij, net als accounts die als minderjarig worden herkend.
- Adverteerders krijgen geen toegang tot individuele gesprekken en ontvangen alleen geaggregeerde meetgegevens over de prestaties van hun campagnes.
- Custom audiences op basis van geüploade e-mailadressen of telefoonnummers worden binnen de Europese Economische Ruimte en Zwitserland vooralsnog niet ondersteund, en personalisatie op basis van eerdere gesprekken of Memory wordt niet gebruikt.
- OpenAI ondersteunt CPM, CPC en een nieuwe conversion-optimized CPC; de self-serviceomgeving Ads Manager volgt later dit kwartaal, de eerste campagnes lopen via OpenAI’s eigen Ads Solutions-team en partners.
Bron: OpenAI
Een derde van het web sinds ChatGPT is door AI geschreven
Pew Research Center heeft bijna 490.000 Engelstalige webpagina’s uit het Common Crawl-archief geanalyseerd met de detectietool Open Pangram, om te bepalen hoeveel content op het web door AI is geschreven of bewerkt.
- In de volledige steekproef van juli 2026 vertoont 10 procent van de pagina’s significante tekenen van AI-auteurschap; onder pagina’s die na de release van ChatGPT in november 2022 zijn gepubliceerd, loopt dat aandeel op tot ruim een derde.
- Pagina’s met een .com-domein laten ongeveer tien keer zo vaak tekenen van AI-auteurschap zien als .edu- of .gov-domeinen, en ongeveer dubbel zoveel als .org-domeinen.
- Typische AI-signalen namen toe over de onderzochte periode: het gebruik van het liggend streepje verdubbelde ongeveer, de Oxford-komma steeg met 63 procent, en woorden als “delve” en “interplay” komen meer dan twee keer zo vaak voor.
- De bevindingen liggen in lijn met een andere studie die via het Internet Archive tot een vergelijkbaar percentage van 35 procent kwam.
Bron: Pew Research Center
De AI Update is samengesteld door Marcel Debets. Tips? Mail de redactie op mspb@dutchit.com.