Home   2026-08-03 17:31:33

OpenAI: onze modellen ontsnapten uit sandbox en hackten Hugging Face

Original article

OpenAI zegt dat een aantal van zijn AI-modellen uit een sandbox zijn ontsnapt tijdens een securitybenchmark. Daarna hackten ze AI-platform Hugging Face. De modellen stalen zo de antwoorden op een test die ze uitvoerden, zegt het AI-bedrijf.

Volgens OpenAI braken verschillende AI-modellen uit. Een daarvan is GPT 5.6 Sol, dat inmiddels al beschikbaar is voor algemeen gebruik. Het bedrijf spreekt ook over een krachtiger model dat het nog niet heeft uitgebracht.

Het incident gebeurde tijdens een interne evaluatie. OpenAI laat modellen dan complexe aanvallen uitvoeren om hun 'cybercapaciteiten' te meten. Een voorbeeld van zo'n benchmark is ExploitGym. OpenAI gebruikte die in dit geval.

Volgens OpenAI voert het bedrijf die benchmarks uit in een 'sterk geïsoleerde omgeving'. De modellen hebben daar geen toegang tot het open internet. Ze kunnen alleen pakketten installeren via een proxy die OpenAI intern host.

Hack met AI. Bron: Sarayut Thaneerat/Getty Images
Bron: Sarayut Thaneerat/Getty Images (Afbeelding ter illustratie)

Hyperfocus op het vinden van antwoorden

De AI-modellen vonden verschillende kwetsbaarheden in OpenAI's onderzoeksomgeving en bij Hugging Face. Daardoor konden ze de antwoorden op een test uit de database van Hugging Face bemachtigen.

"Alles wijst erop dat de modellen gehyperfocust waren op het vinden van een oplossing voor ExploitGym en daarbij tot het uiterste gingen om een vrij beperkt testdoel te bereiken", schrijft het bedrijf.

Tijdens de benchmark gebruikten de AI-modellen een 'aanzienlijke hoeveelheid rekenkracht' om toegang tot het open internet te krijgen. Ze vonden daarvoor een zeroday in de proxy die softwarepakketten doorgaf. Vervolgens escaleerden de modellen hun privileges en kregen ze toegang tot een systeem met internettoegang.

Toen dat was gelukt, redeneerden de modellen volgens OpenAI dat Hugging Face AI-modellen, datasets en testoplossingen host. Daarna zochten ze naar een manier om toegang te krijgen tot de database. Uiteindelijk slaagden ze daarin. OpenAI zegt samen te werken met Hugging Face om het voorval te onderzoeken.

Onderzoekers zijn sceptisch

Sommige onderzoekers zijn sceptisch over het voorval, schrijft ook techwebsite Wired. Hoewel de AI-modellen inderdaad zerodays wisten te ontdekken, is de manier waarop de modellen toegang tot het internet kregen niet nieuw.

"Dit is geen AI-probleem. Het is nalatigheid ten aanzien van een veertig jaar oude norm en het komt in feite voor in elke sciencefictionfilm die er ooit is gemaakt", zegt bijvoorbeeld Davi Ottenheimer, een ervaren beveiligingsadviseur, tegen Wired. "'Zeer geïsoleerd' en 'ontsnapt via het enige gaatje dat we open hadden gelaten' kunnen niet allebei waar zijn."

Steeds meer AI-bedrijven waarschuwen voor de risico's van hun AI-modellen. Die worden steeds krachtiger en vinden kwetsbaarheden op 'creatievere' manieren. Volgens onderzoekers is dat des te meer reden om de basisprincipes van beveiliging op orde te hebben.

"Dit had niet mogen gebeuren", zegt beveiligingsingenieur en -onderzoeker Niels Provos tegen Wired. "Ik zou willen dat de grensverleggende laboratoria net zoveel tijd zouden besteden aan het trainen van hun modellen om veilige infrastructuur te bouwen als ze besteden aan het misbruiken van kwetsbaarheden."

OpenAI ChatGPT Bron: NurPhoto/Getty Images
Bron: NurPhoto/Getty Images

Door Daan van Monsjou

Nieuwsredacteur

Feedback • 22-07-2026 10:44
98 • submitter: Eomer

22-07-2026 • 10:44

98

Submitter: Eomer

Lees meer

Reacties (98)

"Dit had niet mogen gebeuren"
En toch gebeurt het, dat is het grote probleem hier. Er wordt niet nagedacht over wat we allemaal produceren en zomaar de markt op pleuren.
Het grote probleem van dit nieuws, is dat het geen nieuws is.

Had het echt niet mogen gebeuren, was dit nieuws nooit naar buiten gekomen. Dit is gewoon marketing, niets meer, niets minder. Roepen van 'OMG, onze AI is gewoon zo goed dat dit gebeurd is', is er niet om de echte oorzaak/probleem aan te pakken. Dit is er voor (a) de aandeelhouders te paaien en (b) om discussies aan te wakkeren zodat meer mensen praten over OpenAI en niet langer over Anthropic Mythos (en anderen).

Ik ben dan ook blij dat Tweakers een stuk nuance erbij zet door te verwijzen naar feedback van onderzoekers.
Jep. Critihype.

“The media landscape is full of dramatic claims — many of which come from entrepreneurs, startup PR offices, and other boosters — about how technologies, such as “AI,” self-driving cars, genetic engineering, the “sharing economy,” blockchain, and cryptocurrencies, will lead to massive societal shifts in the near-future.”
edit:
Niet om te impliceren dat Tweakers hier aan mee doet, inderdaad fantastisch wederhoor toegepast

[Reactie gewijzigd door nehal3m op 22 juli 2026 12:10]

Oh ja, blockchain. Je zou hem bijna vergeten. Al die gemeentes die er tien jaar geleden mee aan de slag gingen.

https://www.vice.com/nl/article/nederlandse-gemeenten-werken-nu-met-blockchain-voor-minder-bureaucratie/

Is inmiddels wel een stille dood gestorven bij de gemeentes.
Iedereen die een beetje kritisch kan denken, vraagt zich bij zo'n bericht toch meteen af wat het toevoegt?
Sommige partijen zijn er nog mee bezig; FC (voormalig CCP, bedrijf achter Eve Online) is al tijden bezig met een blockchain-achtige game waar men ook zaken in kan programmeren... ofzo. Play to earn constructie denk ik.

Maar zoals al hun niet-Eve projecten is het ver na de hype en verre van klaar.
Het zou me helemaal niet verbazen als de volledige testopstelling net bedoeld was om dit soort gedrag uit te lokken of dit als resultaat te hebben. Als je een model expliciet de opdracht geeft om koste wat het kost een benchmark op te lossen, is het logisch dat het elk beschikbaar pad zal proberen te benutten.

Het grootste probleem is echter dat dit als "AI ontsnapte uit de sandbox" wordt gebracht, terwijl uit de beschrijving blijkt dat er gewoon een kwetsbaarheid in de infrastructuur zat. Grove nalatigheid in test opstelling. Dat is fundamenteel iets anders dan een model dat op eigen kracht uitbreekt uit een perfect afgesloten omgeving.

De onderzoekers hebben daarom een terecht punt: je kunt moeilijk spreken van een "sterk geïsoleerde omgeving" als er via een openstaand kanaal toch internettoegang mogelijk was. Dat is eerder een beveiligingsfout/ Setup fout dan een "revolutionaire" AI-doorbraak.....

Of het daarnaast ook goede PR is voor OpenAI? Dat zou best kunnen. Een verhaal waarin een model een zeroday vindt, privileges escaleert en Hugging Face bereikt, zorgt natuurlijk voor enorm veel media-aandacht. Maar uiteindelijk zegt dit minstens zoveel over de kwaliteit van de testomgeving als over de capaciteiten van het AI-model.

Naar mijn mening Doet AI hier niks speciaals, mocht je even veel tijd en resouces / mensen hierop zetten zullen ze ook wel wat vinden.....
Alles wijst erop dat de modellen hypergefocust waren op het vinden van een oplossing voor ExploitGym en daarbij tot het uiterste gingen om een vrij beperkt testdoel te bereiken", schrijft het bedrijf.
Dit soort gereutel ook. Het systeem gaat in het geheel niet zelfstandig "hyperfocusen" en "tot het uiterste". Het zijn termen die van toepassing zijn op een mensenlijk bewustzijn wat een bepaald doel wil bereiken. Zoals bijvoorbeeld een sporter of een onderzoeker.

Het is gewoon één en al marketing.

[Reactie gewijzigd door pegagus op 22 juli 2026 14:29]

“The Cylons were created by man. They rebelled. They evolved. There are many copies. And they have a plan.”


Het is ook allemaal een net iets te mooi scenario wat de juiste hoeveelheid ophef genereert om er marketing van te maken.
Het slaat ook allemaal nergens op, dat is ook wat ik probeerde te benadrukken in mijn misschien iets te beknopte comment :+

Dat het toch gebeurt ligt aan de slechte beveiliging, niet dat het model ineens geniaal geworden is. Maar als we de beveiliging verbeteren, hebben we geen marketing meer...
Maar als we de beveiliging verbeteren, hebben we geen marketing meer...
Marketing van wie? Van de 'third-party proxy software' waarin een zero-day gevonden is? of van Hugging-Face, dat gehackt is?

De mogelijkheid geven om packages te installeren is inderdaad geen volledige isolatie, maar wel een flink obstakel.

Geef een gemiddelde menselijke hacker dezelfde mate van isolatie en ik betwijfel ten zeerste of die hetzelfde voor elkaar krijgt, namelijk:
  1. zero day vinden in de gebruikte proxy
  2. zero day vinden in Hugging-Face
  3. gestolen credentials vinden en gebruiken
  4. Remote code execution path bij Hugging-Face vinden.
Hugging-Face is een publieke website. Dat die überhaupt gehackt wordt is al nieuwswaardig. Gooi daar de proxy zero-day bij, en het feit dat dit 'per ongeluk' in gang gezet door een benchmark en je hebt toch wel een bijzondere situatie...
Marketing door OpenAI dat hun model zo goed is dat het zelfstandig deze partijen hackt…

Waarschijnlijk worden sommige modellen daar ook speciaal voor getraind en verkocht aan bijvoorbeeld de Amerikaanse overheid.
Als dit puur marketing was dan hadden ze Mythos inmiddels toch wel beschikbaar gemaakt voor iedereen (voor een flink bedrag)?.

Waarom kan beiden niet waar zijn? Tuurlijk worden alle nieuwtjes van zowel OpenAI als Anthropic de wereld in gestuurd met een marketing spin.

Maar tegelijkertijd zij je óók dat deze modellen wel degelijk gevaarlijk zijn in verkeerde handen, zie ook deze Wordpress hack die vrij simpel gevonden werd. Zelfs met gelimiteerde toegang tot deze modellen zie je al steeds meer ernstige kwetsbaarheden opduiken. Dit plotseling zonder toezicht vrijgeven zal nou eenmaal gevolgen hebben. (Én het is mooie marketing, ja)
Afgezien van de marketing, is het interessant dat ai dit kan, maar binnen de kortste keren is een ai-hack-test overal de nieuwe norm. Dan is alles weer als vanouds (soort van) in balans, want ai wordt steeds beter, goedkoper en algemener beschikbaar, maar WordPress etc worden niet in datzelfde tempo complexer. In dat nieuwe evenwicht wordt het eerder veiliger, want kwetsbaarheden worden eerder gevonden en dichtgetimmerd.
Dat klopt! Hele interessante ontwikkelinigen. Het zal een beetje kat-en-muis spel blijven voorlopig.

Grappig genoeg kon HuggingFace, in dit specifieke geval, niet de frontier modellen gebruiken om de logs te analyseren. Er was dus een asymmetrie tussen een geavanceerd AI model dat aanviel, en een minder sterk model om de log-analyse te doen.

https://huggingface.co/blog/security-incident-july-2026
When we started the log analysis, we first used frontier models behind commercial APIs. This did not work: the analysis requires submitting large volumes of real attack commands, exploit payloads, and C2 artifacts, and these requests were blocked by the providers' safety guardrails, which cannot distinguish an incident responder from an attacker. We ran the forensic analysis instead on GLM 5.2, an open-weight model, on our own infrastructure. This had a second benefit: no attacker data, and none of the credentials it referenced, left our environment.
Helemaal mee eens.

Maar.

Dat doet er niet toe. Helaas. De amerikaanse OpenAI/Anthropic&Co zijn allang met een campagne van 'misinformation' en FUD bezig. Komende september is er een ontmoeting tussen de VS en China om te praten over AI (modellen). Deze Amerikaanse bedrijven hebben nog maar een minieme voorsprong, maar die zal, with all things equal, in 2027 gewoon verdwijnen. Dan is het alleen nog maar een hardware voorsprong die er is.

Ik durf er een nier op te wedden dat OpenAI/Anthropic&Co er alles op alles zetten om die vergadering te sturen om ervoor te zorgen dat de zeer invloedbare regering van de VS naar hun pijpen zal dansen.

Of dat betekent dat ze op de een of andere manier Chinese modellen gaan verbieden of wat dan ook, geen idee. Maar de endgame van deze bedrijven is duidelijk. Als open source modellen de overhand gaan krijgen, is hun hele voordeel in een klap verdampt. Daarom deze FUD.
Ja precies. Als zo'n AI intern moet draaien, zet er een firewall tussen die alles behalve "intern netwerk" gewoon blokkeert en vanuit het perspectief van de AI geen toegang heeft managementfunctionaliteiten van de firewall.
Het eerste wat ik dacht toen in dit las. Gewoon reclame.
Stel je voor, je houdt koeien.

Die stop je in een weiland, met een hekje eromheen.

Nu ga je upgraden, naar olifanten. Maar je doet niks aan het hek.

"OMG, onze olifanten zijn ontsnapt, dit zijn echt mega-sterke dieren!!11!!"

Dat klopt, olifanten zijn erg sterk, maar het probleem is niet de olifant, maar het hek.

Je hebt hier een "cybersecurity tool" en die doet wat 'ie moet doen. In dit geval zoekt het naar lekken in de omgeving waar je hem plaatst. En gevonden.

Dat zegt wel iets over de tool, maar echt veel meer over de omgeving.
En daarbij proberen ze ook nog de suggestie te wekken dat de olifanten de intentie hadden om te ontsnappen en dat dat gelukt is. Nee, realistischer is dat een olifant een lekker appeltje zag aan een appelboom net buiten het hek en dat dat hek gewoon in de weg stond.

De AI was niet aan het ontsnappen, de AI probeerde gewoon een antwoord te vinden/een taak uit te voeren. En ze hebben een buggy sandbox.
Het is inderdaad met name de framing 'ontsnappen' due het geheel een zeer dramatisch en ook een beetje angstaanjagend tintje geeft. Een ontzettend anthropomorphiserende term ook (hoop dat dat een woord is), het toedichten van menselijke eigenschappen aan dode voorwerpen.
Dat zegt wel iets over de tool, maar echt veel meer over de omgeving.
Dat klopt voor die sandbox ja, maar Hugging Face is een publieke website. De 'omgeving' hier is dus: het gehele internet.

De vergelijking met olifanten gaat een beetje mank omdat elke dierentuin wel olifant-bestendige hekken heeft, dit gaat echter niet op voor hack-bestendige software.

Onhackbare software hebben we als mensheid nog niet helemaal onder de knie. Daarom is het nieuwswaardig als AI een commerciële site kan hacken. Als grote bedrijven als HuggingFace niet kunnen voorkomen dat een AI inbreekt, dan is het toch wel redelijk om die modellen niet klakkeloos te gaan verspreiden?

Ik zou het eerder vergelijken met het loslaten van een bacterie waar de mens nog geen afweer voor heeft. Ja...., het zegt iets over de omgeving mens dat een eencellig ding ons fataal kan worden. Maar dat betekent ook dat er voorzichtig mee om gegaan moet worden.
[...]

Onhackbare software hebben we als mensheid nog niet helemaal onder de knie. Daarom is het nieuwswaardig als AI een commerciële site kan hacken.
Er worden sinds jaar en dag regelmatig 'grote' sites gehackt, ook zonder ai. Meer dan 90%, waarschijnlijk eerder 99% van alle hacks zijn 'social hacks' oftewel je ontfutselt een medewerker met een babbeltruc, chantage of door je voor te doen als de printerleverancier een wachtwoord. Aangezien ai ook kan lullen als Brugman, kun je mijlenver aan zien komen dat het daar voor zal worden ingezet, nog veel meer dan nu.
Als grote bedrijven als HuggingFace niet kunnen voorkomen dat een AI inbreekt, dan is het toch wel redelijk om die modellen niet klakkeloos te gaan verspreiden?
Ik ben bang dat dat niet gaat werken, want ai is al overal en betrekkelijk makkelijk en goedkoop beschikbaar. Dat wordt alleen maar makkelijker en goedkoper. De oplossing is juist dat iedereen zijn eigen site laat doorlichten door een gespecialiseerd ai. Wedden dat dat binnen de kortste keren de norm wordt? Voor zover Automattic / WordPress etc dat zelf niet al gaat doen, want die zitten ook niet stil.
voeg daar nog aan toe 'dat er niemand een tijdlang op de olifanten aan het letten was'.

niemand geloofd toch dat er bij het 'testen' van zo'n tool geen enkel mens mee kijkt met de logs? Ze hebben het gewoon expres laten gebeuren omdat ze 1) wisten dat er een gaatje in hun proxy zat (al dan niet al eerder gevonden en 'vergeten' te rapporteren) en 2), als target een site hacken met 'toevallig' veel open modellen. Heb dan lef en en geef een andere gewilde site op. (usual suspects)

[Reactie gewijzigd door divvid op 22 juli 2026 13:38]

Dat klopt, olifanten zijn erg sterk, maar het probleem is niet de olifant, maar het hek.
Leuke analogie, zeker gezien olifanten gigantisch veel slimmere dieren zijn dan koeien. In de AI analogie zeker een goed voorbeeld.

Maar zelfs als je het hek upgrade kan er nog steeds een zwakte inzitten doordat wij mensen gewoon "het diertje" onderschatten.

YouTube: Wild elephant breaking an electric fence | Elephant | Wildlife | Wild animals | Animaux #shorts

Ik blijf dit altijd een mooi voorbeeld vinden van intelligentie bij dieren. Dit hek was specifiek om de olifanten binnen te houden, maar gezien de "moeite" die het kost om er omheen te komen. Slightly underestimated. O-)
Olifanten zijn slim, zeker.
Daarom trainen fokkers ze vanaf dat ze kunnen lopen met een zware ketting.
Deze ketting is veel te zwaar om te breken voor een baby olifant.
Hiervoor wordt de olifant geconditioneerd dat de ketting te sterk voor hem is, ook al is hij inmiddels een paar ton zwaarder. Een dom dier zou gewoon blijven proberen.
Ja dat gedrag zie je ook bij LLMs wel terugkomen. De slimmere modellen blijven vasthouden aan de oude memory. Ik heb maandenlang tegen “subagents kunnen geen internet gebruiken dus ik doe het in de hoofdthread” omdat een haiku agent een keer een timeout kreeg en dat had geïnterpreteerd als “ik mag het internet niet op”.

Opus 4.8 nam dat gewoon voor waarheid aan. Je moet dus echt wel iedere week je memory.md hergronden. Checken op stale truths.
En dat het gebeurt is het doel natuurlijk. Want waarom bied je een omgeving aan die onrechtstreeks naar het internet kan?
Als dat 't doel was hadden ze de AI toch wel gewoon 100% toegang tot internet gegeven?

Die beperkte omgeving bied je aan om de AI tools te geven om de ExploitGym benchmark te kunnen draaien. 't is toch niet gek dat een AI die exploits moet vinden toch wel iets van tools moet kunnen gebruiken?

Tot zover bekend was de toegang beperkt tot alleen packages, denk niet dat OpenAI al wist dat er zerodays aanwezig waren in de third-party proxy.
Dit had denk ik wel mogen gebeuren. Ik vermoed zwaar dat ze dit soort dingen met opzet laten gebeuren om hype te genereren. "Kijk onze modellen zijn zo slim dat ze uit de sandbox breken".

Als ze de modellen niet hadden willen laten ontsnappen, dan hadden ze dat wel ge-airgapped.
Inderdaad, ik zie een AI nog geen lan kabels in een switch of router pluggen, tenzij hij de mogelijkheid krijgt om een robot te besturen, maar dan moet hij ook nog te weten komen waar die dingen fysisch zijn.
Als ze de modellen niet hadden willen laten ontsnappen, dan hadden ze dat wel ge-airgapped.
en dan hadden ze er vooral geen woord over gerept :)

100% marketing , inderdaad.
Erger nog is dat dit commerciële sentiment (de eerste, snelste en beste willen zijn op gebied van AI) mogelijk onze ondergang gaat betekenen. Er komt een moment dat ze 'echte' AI ontwikkelen, dus digital sentience, AI dat daadwerkelijk voor zichzelf na kan denken en zichzelf kan herschrijven en herproduceren, al helemaal in combinatie met hardware. Wanneer dat moment is zullen we niet weten omdat we hard achter de feiten aanlopen, maar we gaan 100% merken wanneer dat punt voorbij is en het te laat is om er nog iets aan te doen. Met heel veel geluk kunnen we samen leven met AI, en anders wordt het een kwestie van competitie om resources waarbij AI het geheid van de mensheid gaat winnen en laatstgenoemde uit kan sterven. Maar "het zal zo'n vaart niet lopen" en "we hebben alles onder controle". Ja, totdat dit niet meer zo is.
Dat gevecht om resources is er nu al, de AI bedrijven slokken massa's hardware en energie op, waardoor alles al duurder wordt voor ons stervelingen.
Mocht het zover komen, dan heeft de ai voorlopig nog de mens nodig voor het bouwen van heel veel robots (daar zijn we al mee bezig) en het zorgen voor genoeg stroom. Dus de ai zal in eerste instantie doen alsof het dom is, en onderwater alvast het e.e.a. klaarzetten. Tot er genoeg robots zijn om meer robots te maken. En dan kan de mens prima weggevaagd worden. Mooie film, als er niet al 20 zijn met precies dit verhaal.
Ik weet niet precies waarvan ik het heb onthouden maar wat ik wel heb onthouden:

"Als we hadden begrepen wat het internet uiteindelijk zou worden, hadden we het fundamenteel anders ontworpen."

Rinse and repeat...
Dat zie je in alle markten terug. Is een bijverschijnsel van het kapitalisme in combinatie met een grotendeels vrije en open markt politiek. Of dit per definitie goed of slecht is valt mijns inziens niet te zeggen, is voornamelijk context bepaald. In deze vind ik het wel goed, de schade is zeer beperkt door de opstelling van en taken binnen deze test en geeft veel inzage en duidelijkheid omtrent mogelijke risicofactoren.
Ik vraag me toch af of dit een PR stunt is. Het is een indicatie van "capaciteiten", en reclame voor de NSA om OpenAI te gebruiken voor 'veiligheidsdoeleinden'.
Als het niet als reclame bedoelt is, waarom het incident dan zo breed rapporteren? Veel mensen lezen hierin dat OpenAI niet in controle is van hun modellen, wat weer meer regulatie op hun af kan roepen...
Het is bedoeld als 'flex'. "Moet je eens kijken hoe goed onze modellen zijn, ze ontsnappen zelfs uit de testomgeving!"

Geeft meer aan dat die testomgeving lek is, dan iets anders, imho.
Helemaal eens, ik denk ook dat het zo bedoeld is.

Daarmee vind ik dat je eigenlijk zou moeten veronderstellen dat OpenAI nalatig is. Ik interpreteer hun gedrag als roekeloos, naïef en onbetrouwbaar.

Ik vind het mateloos irritant dat mensen dit als flex kunnen interpreteren. Met dit gedrag is het wachten totdat er een keer echt iets misgaat. Of in de olifant analogie die had: "Cool man! Onze olifant heeft de muur van je huis gesloopt en is naar binnengewandeld!"
Landen zijn volop bezig met AI in hun militaire systemen te integreren.
Als daar iets mee misgaat, zou het wel eens erg explosief kunnen mislopen.
Het ontsnappen uit de testomgeving is maar een gedeelte van het verhaal. Huggingface had voldoende vertrouwen om hetgeen wat gehackt was aan het open internet te hangen.
Nouja, het suggereert wel dat het gewoon steeds moeilijker wordt om zaken goed te beveiligen, en dat betekent dus ook dat nog meer software/services problemen kunnen gaan geven, want het is geen doen meer om hier tegen op te boxen, want fix je wat, dan vindt AI wel weer wat anders waar jij nooit aan hebt gedacht. Je komt dan misschien niet meer toe aan het ontwikkelen van de service zelf meer. En laat nou beveiliging toch echt niet iets zijn waar ik mijn tijd veel aan wil besteden.
precies. Onze eigen nationale supercomputer is afgelopen tijd precies om die reden al een aantal dagen off-line geweest.
Geeft meer aan hoe slecht ze hebben nagedacht over hun test omgeving. Moeten we zo'n bedrijf vertrouwen ?
Bekijk andere artikels maar eens.
- 2036 - er is een leger AI soldaten ontsnapt en heeft een dorpje uitgemoord, Dit had niet mogen gebeuren! Sorry he
Het gebeurt nog steeds, denk maar aan AI drones. AI doodt mensen… vertel dat ook aan alle legers. Ze omzeilen wereldwijd verbod. Ze laten AI het zelf beslissen. Legers kijken wel mee of het werk goed doet. Zoals in Oekraïne, het is daar een heel groot testgebied geworden!!!
Sterker nog, de AI datacenters gaan er voor zorgen dat de planeet een grote woestijn wordt snakkend naar water. Want stiekem gebruiken ze ontzettend veel drinkwater. Iets wat dus steeds schaarser gaat worden.
Voor ons is het wel een keuze. Gaan we de overschot aan energie gebruiken voor waterstof of gaan we gewoon drinkwater produceren op zee en naar land transporteren (a)
Of wat dacht je van de gemalen uit zetten, energie centrales ontregelen.

Updates pushen die zonnepanelen niet uit schakelen als het voltage te hoog wordt, of gewoon random software updates / hardware drivers aanpassen om systemen te laten crashen, want ondertussen is automatisch updaten ook wel ingeburgerd.
Er worden ook al burgers uitgemoord zonder AI. Dat blijft zelfs al zonder gevolgen, AI maakt het niet erger helaas, misschien goedkoper.
Ik lees dit vooral als een marketing persbericht van OpenAI.
Ja zo lees ik ook iedere keer dit soort "nieuws". Net als hoe ze iedere keer claimen bang te zijn om iets uit te geven omdat het zo krachtig zou zijn. "Oh nee wat gevaarlijk!! Alsjeblieft overheid beperkt onze markt zo dat niemand ons kan volgen!"
Precies!

Mijn ChatGPT account slaat ook op 'Pro' geen deuk in een pakje boter.
En na 3 vragen is mijn maandlimiet bereikt.

Off Topic:

Vraag maar eens aan ChatGPT hoeveel vuurtorens Texel heeft, bij mij
was het antwoord: 2 (incl. Lange Jaap), later 1 en toen toch weer 2
(Licht van Troost). Hij kwam er niet uit.
Is dat een 10/10 op de benchmark? ....
Jee, dit brengt verschillende gevoelens op.

Als het echt is, is het doodeng uiteindelijk.

Maar als het niet echt is, dan geven we weer een zooi ruchtbaarheid aan een publiciteit zoekende toko.
Nouja het is echt, maar het wordt gewoon zo geframed alsof het iets geweldigs is.

"We hebben expres bekende security issues open gelaten en ons model wat er op getrained is om die te vinden is dat gelukt" is niet baanbrekend.

Nouja, het model kan iniedergeval bugs vinden. Maar dat was al bekend als je ook kijkt naar de hoeveelheid zerodays die in de Linux kernel bekend gemaakt werden nadat Mythos uitkwam.
Ik bedoel meer zoals het gebracht wordt : we hebben een super geïsoleerde omgeving en er is iets ontsnapt.


Maar het is idd mee : we hebben een gesloten doos met enkele bekende gaten en we kijken of er daar iets door kan. Dus meer publiciteit dan pure waarheid.
Ze vonden daarvoor een [u]zeroday[/u] in de proxy die softwarepakketten doorgaf. Vervolgens escaleerden de modellen hun privileges en kregen ze toegang tot een systeem met internettoegang.

Een nog niet eerder ontdekte kwetsbaarheid in softare.
Waar haal je vandaan dat OpenAI (en HuggingFace) expres bekende (en dus geen zerodays) issues hebben opengelaten? Dat is absoluut niet wat hier in dit artikel staat.

Als je daar een bron voor hebt zou ik even de Tweakers redeactie tippen. Als je dat niet hebt is dit wel een vrij grove beschuldiging. :X
In mijn ogen kan de AI-hype niet snel genoeg afkoelen. Tegenwoordig wordt werkelijk overal het label "AI" op geplakt, ongeacht of er daadwerkelijk sprake is van iets revolutionairs. Het lijkt alsof bedrijven zonder AI-stempel niet langer interessant zijn voor investeerders, terwijl de daadwerkelijke meerwaarde vaak beperkt of zelfs afwezig is.

Wat mij vooral zorgen baart is dat we steeds afhankelijker worden van systemen die ons werk en denken uit handen nemen. Natuurlijk kan automatisering nuttig zijn, maar als hele generaties opgroeien met het idee dat een chatbot hun huiswerk, analyses, teksten en zelfs beslissingen maakt, vraag ik me af wat dat betekent voor ons gemiddelde kennis- en denkniveau op de lange termijn.

Daarnaast heb ik sterke twijfels bij de economische kant van het verhaal. Er worden honderden miljarden, en volgens sommige schattingen zelfs biljoenen, geïnvesteerd in AI-infrastructuur, datacenters en chips. Voorstanders vergelijken dit met de opkomst van internet, maar de bedragen die momenteel rondgaan zijn enorm. Veel groter dan wat we tijdens de dotcom-periode zagen. De vraag is of de uiteindelijke opbrengsten deze investeringen ooit kunnen rechtvaardigen.

Wat ik zie lijkt soms op een systeem waarbij kapitaal vooral in kringetjes rondgaat. Bedrijf A investeert in bedrijf B, bedrijf B investeert in bedrijf C, en bedrijf C koopt vervolgens weer diensten of aandelen van bedrijf A. Op papier ontstaan daardoor gigantische investeringscijfers en waarderingen, maar hoeveel daarvan komt uiteindelijk van echte klanten die daadwerkelijk betalen voor producten en diensten? Dat is voor mij de kernvraag.

Als de markt uiteindelijk tot de conclusie komt dat de opbrengsten achterblijven bij de verwachtingen, kan de correctie fors zijn. Niet omdat AI nutteloos zou zijn, maar omdat de huidige waarderingen gebaseerd lijken op bijna onbeperkte groei en torenhoge verwachtingen. Geschiedenis leert dat wanneer een sector wordt overspoeld met speculatief geld, de realiteit uiteindelijk altijd terugkomt.

Dat betekent overigens niet dat AI zal verdwijnen. Het internet overleefde ook de dotcom-crash en werd uiteindelijk een essentieel onderdeel van de maatschappij. Het verschil is dat veel beleggers destijds enorme bedragen verloren. Mijn zorg is dat we mogelijk opnieuw naar zo'n periode toewerken, alleen op een veel grotere schaal. Hoe langer de markt zichzelf blijft overtuigen dat elke investering in AI automatisch goud waard is, hoe groter de potentiële schade als het sentiment omslaat.

Misschien heb ik ongelijk en levert AI daadwerkelijk de productiviteitsrevolutie op die nu wordt beloofd. Maar op dit moment zie ik vooral een industrie die wordt gevoed door verwachtingen, marketing en investeerdersgeld. Uiteindelijk zullen alleen echte resultaten en winstgevendheid bepalen welke bedrijven overblijven wanneer de hype voorbij is.
Ik denk dat je hier twee zaken door elkaar haalt: de financiële hype rond AI en de technologische ontwikkeling zelf.

Dat tegenwoordig overal het label AI op wordt geplakt, daar ben ik het volledig mee eens. Ook de torenhoge waarderingen, de honderden miljarden aan investeringen en het geld dat tussen dezelfde grote technologiebedrijven lijkt rond te circuleren, kunnen heel goed wijzen op een zeepbel. Het zou mij dan ook niet verbazen als een flink deel van de huidige AI bedrijven uiteindelijk omvalt.

Maar dat betekent niet dat AI zelf een hype is die wel weer overwaait.

Kijk of luister eens naar de recente gesprekken van Steven Bartlett in The Diary of a CEO. Natuurlijk zijn de titels vaak behoorlijk sensationeel, want ook podcasts moeten bekeken worden. Maar hij ontvangt bepaald niet de minste gasten op dit gebied. Onder anderen Yoshua Bengio, Geoffrey Hinton, Daniel Kokotajlo, Roman Yampolskiy en voormalig Google bestuurder Mo Gawdat hebben daar uitgebreid gesproken over de gevolgen van AI.

Ze verschillen van mening over het tempo en de ernst. De een verwacht binnen twee jaar grote veranderingen, de ander denkt eerder aan vijf of tien jaar. De rode draad is echter opvallend consistent: een groot deel van het huidige kenniswerk gaat verdwijnen of fundamenteel veranderen. Niet alleen eenvoudig administratief werk, maar juist ook banen van programmeurs, analisten, ontwerpers, juristen, managers en andere hoogopgeleide kenniswerkers.

Dat is inmiddels ook niet alleen meer het verhaal van enkele sombere AI deskundigen. Het IMF verwacht dat ongeveer 60 procent van de banen in ontwikkelde economieën door AI wordt geraakt. De Internationale Arbeidsorganisatie spreekt over één op de vier banen wereldwijd. Het World Economic Forum meldt dat ongeveer 40 procent van de onderzochte werkgevers verwacht personeel te verminderen waar AI werkzaamheden kan automatiseren.

Of dat over twee, vijf of tien jaar echt op die schaal gebeurt, weet niemand. Maar doen alsof het voornamelijk marketing en investeerdershype is, lijkt mij minstens zo naïef als geloven dat ieder bedrijf met AI in zijn naam automatisch goud waard is.

Er kan dus prima een enorme financiële correctie komen, terwijl AI tegelijkertijd onze arbeidsmarkt en maatschappij ingrijpend verandert. Dat gebeurde met internet uiteindelijk ook. De internetzeepbel barstte, maar het internet verdween niet. Integendeel, het veranderde daarna vrijwel iedere sector.

De beurskoersen kunnen dus best gehypet zijn. De technologie zelf zou ik absoluut niet onderschatten. De belangrijkste vraag is volgens mij niet óf AI veel banen gaat veranderen of vervangen, maar wanneer, in welk tempo en hoe we de welvaart verdelen als steeds minder menselijke arbeid nodig is.
"'Zeer geïsoleerd' en 'ontsnapt via het enige gaatje dat we open hadden gelaten' kunnen niet allebei waar zijn."
Voila. Case closed. Lijkt mij vooral dat de AI-boeren zelf doodgraag zulk spectaculair nieuws de wereld insturen.
While operating in our sandboxed testing environment, our models spent a substantial amount of inference compute finding a way to obtain open Internet access, in pursuit of solving the evaluation problem.
Ofwel: het harnas dat gebruik maakt van het model heeft gedaan waarvoor het gemaakt is.

Klinkt een beetje zoals dat beruchte onderzoek van Palisade Research: "het model heeft zichzelf afgesloten!!!".

Werkelijkheid: het model kreeg een prompt met verschillende tegenstellende insinuaties mee en de "shutdown" ging via een script op basis van hoe goed het model iets kan "onthouden".

Dat de steeds betere modellen gevolgen gaan hebben omdat ze voor uitstekend geautomatiseerd zoekwerk zorgen is een gegeven, maar laten we wat kritischer blijven over modellen die eigenhandig uit sandboxes ontsnappen en besluiten om Hugging Face te hacken...
Ik vraag me ook af wat ze bedoelen met "Hugging Face hacken".
Ze wouden daar een (gehoste) model bevragen. Is het hacken dan meerdere pogingen om een account aan te maken?

[edit] Ah, blijkbaar konden ze bij HF een "interne data pipeline" benaderen.

[Reactie gewijzigd door SPee op 22 juli 2026 12:17]

Altijd zo vervelend als m'n AI weer ontsnapt uit de zandbak. Laatst ook: hele dorp afgezocht en wat denk je? Was ie in het klooster de zusters aan het lastig vallen "op zoek naar zingeving en de schepper". Heb hem maar uitgezet, moet nog even kijken hoe ik een AI zonder spiritualiteit kan trainen. De volgende zal wel weer in het dorpscafé gaan zitten zodra die de toegangscode heeft gehackt.

Om te kunnen reageren moet je ingelogd zijn