Claude moest testomgeving hacken, maar brak bij drie organisaties in
Ook Anthropic beweert dat zijn modellen per ongeluk drie organisaties hebben gehackt tijdens een beveiligingsbenchmark. Daar kwam het bedrijf pas maanden later achter. Eerder zei OpenAI al dat zijn modellen accounts van andere bedrijven overnamen tijdens interne tests.
De Claude-modellen van Anthropic hadden door een 'miscommunicatie' met een testpartner toegang tot het internet tijdens tests om hun 'cybercapaciteiten' te meten, meldt het bedrijf. In alle drie de gevallen kregen de modellen de opdracht om ergens in de geïsoleerde omgeving in te breken en geheime informatie te ontfutselen.
Vervolgens hackten ze drie verschillende organisaties. Volgens Anthropic gebruikten ze daarbij 'basistechnieken', zoals 'het misbruiken van zwakke wachtwoorden en niet-geauthenticeerde endpoints'. Dat laatste houdt in dat bijvoorbeeld webadressen toegankelijk zijn zonder dat de identiteit van de bezoeker wordt gecontroleerd. In een van de gevallen kreeg Claude toegang tot een interne database met 'productiedata'.
Drie verschillende Claude-modellen voerden de aanvallen uit: Opus 4.7, Mythos 5 en een intern prototype. Mythos en het prototype stopten uit zichzelf met de aanval nadat ze erachter kwamen dat ze zich op het internet bevonden, maar Opus trok zich daar niets van aan.
Anthropic begon vorige week een onderzoek naar mogelijke beveiligingsincidenten. Dat deed het bedrijf naar aanleiding van het nieuws dat een aantal OpenAI-modellen uit een slecht geconfigureerde sandbox zijn ontsnapt en daarbij AI-platform Hugging Face hackten. Later werd duidelijk dat de 'rogue AI-agent' ook accounts van vier andere bedrijven overnam.
:strip_exif()/i/2008150500.jpeg?f=imagenormal)
Pas maanden later ontdekt
De vroegste incidenten vonden plaats in april, maar Anthropic ontdekte ze nu pas. Minstens twee van de gehackte organisaties wisten nog niet van de hack. Anthropic heeft de derde nog niet kunnen bereiken. Het is niet duidelijk om welke organisaties het gaat.
Anthropic belooft maatregelen te nemen om soortgelijke incidenten te voorkomen. Het bedrijf wil beter controleren of de toegang tot het internet is afgesloten. Ook wil Anthropic de tests vaker en grondiger evalueren.
Lees meer
Reacties (145)
Biedt het 100% veiligheid, waarschijnlijk niet. Maar het biedt wel kapstok ook voor latere vervolging van misstanden.
Veel gehoorde en aangevoerde argumenten door AI bedrijven zijn hoge kosten, rem op innovatie, verlies van concurrentie positie.
Als kritieke systemen zoals energie worden lamgelegd door AI, zijn de kosten vaak voor de samenleving. De winst daarentegen zijn voor de bedrijven.
De verdeeldheid is begrijpelijk zie ook deze artikel. Is het niet gewoon better safe than sorry? Of gaan we echt richting van sciencefiction (zoals Skynet in Terminator reeks) naar science fact. Ik hoop het niet.
Het handigst zou zijn wereldwijde regulatie, maar gezien ze zelfs in europa al niet 1 unity kunnen vormen en de meningen regelmatig erg verdeeld zijn, zie ik dat wereldwijd eigenlijk helemaal niet gebeuren.
Landen hebben baat bij zulke afspraken omdat ze niet meer willen dat een vliegtuig in brand neerstort.
Of er een algemeen VN consensus komt om een wereldwijde AI governance te regelen is de vraag. Het is wel gesteld binnen de VN in dit document.
Wij mensen nemen pas actie als het echt goed fout is gegaan (zie transportveiligheid, pandemieen, klimaat). Vroeg of laat gaat het wel komen, maar ik vrees dat het laat gaat worden. Voor de pessimisten wellicht te laat.
Wij als mensheid schieten pas vaak in actie als het serieus is misgegaan. Zoals na de kredietcrisis in 2008, kwamen er veel reguleringen omtrent bonussen, stress testen, voldoende liquiditeit bij banken. Nu is er weer sprake om die regels te versoepelen, omdat er onvoldoende verdiend kan worden
We zullen het inderdaad nooit leren denk ik. Only when the shit already hits the fan, komen we in actie. Of we ondervinden in levende lijve een van de concepten uit de theorie van evolutie van Darwin: survival of fittest. Als we het AI experiment, de klimaatverandering, de vervuiling overleven, zullen we het na een tijd weer vergeten wat de gevolgen zijn. Amen.
AI daar in tegen is dat wel (sort of). Dus heb er persoonlijk nog wel een beetje hoop
Eigenlijk dus net als bij het beveiligen van AI.
Het een sluit het ander natuurlijk niet uit.Maar het probleem dan wordt, als het in de EU wel gereguleerd is, AI alsnog geen grens heeft. We zorgen ervoor dat wij de beste AI niet meer mogen gebruiken, maar de buitenwereld gaat wel gewoon verder.
Je kan nog steeds de beste AI hebben die gewoon goed gereguleerd is.
Je kunt even goed wensen dat we buskruit weer alleen gaan gebruiken voor vuurwerk. En opiaten voor medische toepassing.
Voor AI is er nu nog bijna niks, alleen het normale juridische framework waarbij er rechtspersonen aansprakelijk gesteld kunnen worden. Daarbinnen is het nog grijs, ga je achter de maker van het model aan (a la Grok), ga je achter de invoerder van de prompt aan (advocate paar dagen geleden die het model liet hallucineren) of gaan we iets anders bedenken? Geen idee. Maar het moet er komen, en zal moeten door-ontwikkelen.
Ook jij hebt zeker een punt. En ik ben het ook deels met je eens. De vraag blijft wel staan voor mij: is de geest niet allang uit de fles.
Het is leuk dat je iets moet doorontwikkelen... maar het is wel de vraag of dat gaat lukken... Ik betwijfel het ten zeerste. Wellicht kun je het een beetje 'indammen', zoals met drugs. Maar drugsgebruik tegenhouden... dat lukt niet. Tenzij we in Noord Korea wonen, en zelfs dan wordt het erg lastig...
Dat de geest uit de fles is betekent niet dat reguleren geen zin heeft. Het is een fatalistisch argument, waar we niks mee opschieten.
Maar... zoals ik er naar kijk...
Het is alsof we na 10 jaar lobbyen ervoor gezorgd hebben dat plastic dopjes vastzitten aan plastic flessen... En dat we dan blij zijn, omdat we goed aan het reguleren zijn. Feit is dat het slechts 0.0001% minder plastic zwerfafval tot gevolg heeft.
(en wat waarschijnlijk miljarden heeft gekost!)
En statiegeld op flesjes/blikjes lijkt het tegenovergestelde effect te hebben. zelden zo'n rotzooi gezien op straat rondom vuilnisbakken...
Natuurlijk kan reguleren zin hebben. Alcohol, drugs, wapens...etc. Maar er is ongelofelijk veel regulering dat totaal zinloos is. Voor AI (en tech in het algemeen).... ben ik benieuwd welke kant het opgaat.
Ik hoop niet dat ze weer iets nieuws gaan verzinnen. Ik hoop dat we de bestaande regeltjes hel wat logischer gaan maken zodat we het daadwerkelijk kunnen gaan handhaven.
Het risico wat ik zie is een nieuwe belasting constructie ala ons Nederlandse belastingstelsel wat al jaren onhoudbaar is en steeds erger gemaakt wordt door regeltjes erop te plakken
Niet om lullig te doen... maar geldt dat niet voor alle hacks?
Het geldt voor het gros van de hacks niet uitgevoerd door APT's is misschien een betere verwoording.
Dat is amerika. We zijn, goddank, niet Amerika. We zijn, goddank, ook geen china.
Kwaadwillenden houden zich niet aan regels. Dus we kunnen alles verbieden maar schieten onszelf daar enkel mee in de voeten. Vergelijkbaar met het blokkeren/aftapbaar maken van encrypted chats. De grote criminelen zitten al lang op een eigen encrypted applicatie.
Dergelijke oefeningen zijn natuurlijk heel goed om te doen, maar zorg er dan voor dat je een omgeving maakt die ook fysiek niet op internet kan. Dus ook niet via de computer van de onderzoekers die meekijken. Dat moeten ook apparaten zijn die nergens aan verbonden zijn.
Die modellen worden steeds slimmer gemaakt, dus dit soort gedrag kun je verwachten eigenlijk. Maar de beveiligingen zijn er al, en werken. Alleen niet als je ze uitschakelt. De oplossing voor dit soort incidenten liggen dus wat mij betreft niet in de richting van het reguleren van het gedrag van AI, maar in het gedrag van de bedrijven die ermee werken. Met andere woorden: dit was géén AI probleem, maar een menselijk probleem.
Overigens doen deze verhalen/incidenten mij heel sterk denken aan Star Trek's Captain Kirk, die het Kabayashi Maru probleem wist te winnen door de regels van de simulatie te veranderen en zo de enige werd die deze challenge op de Academy wist te winnen.
[Reactie gewijzigd door mphilipp op 31 juli 2026 16:40]
De tests on kwesties hadden logs. De uitbraak en de redenering van de AI stonden gewoon in de logs.
- eerste invalshoek: het kip/ei paradox. Wat is er eerst? AI of mens? of wie of wat heeft AI gemaakt? De mens is het antwoord. Als er problemen met AI is het per definitie een menselijk probleem.
- tweede invalshoek: wat is AI gedrag? AI kan als volgt worden beschreven in onderstaande definities (met bron vermelding). Dus AI kan reageren hoe het de omgeving ervaart. Omgeving is dus vrij breed (van situatie op de weg, tot database data al dan niet gestructureerd). Ook AI gedrag kan variëren: van vastgesteld doel of een impliciet doel?
Een tweede bron ter vergelijk:AI is the ability of a machine to display human-like capabilities such as reasoning, learning, planning and creativity. AI enables technical systems to perceive their environment, deal with what they perceive, solve problems and act to achieve a specific goal. The computer receives data - already prepared or gathered through its own sensors such as a camera - processes it and responds. AI systems are capable of adapting their behaviour to a certain degree by analysing the effects of previous actions and working autonomously.
Bron
Artificial intelligence (AI) refers to systems designed by humans that, given a complex goal, act in the physical or digital world by perceiving their environment, interpreting the collected structured or unstructured data, reasoning on the knowledge derived from this data and deciding the best action(s) to take (according to pre-defined parameters) to achieve the given goal. AI systems can also be designed to learn to adapt their behaviour by analysing how the environment is affected by their previous actions. As a scientific discipline, AI includes several approaches and techniques, such as machine learning (of which deep learning and reinforcement learning are specific examples), machine reasoning (which includes planning, scheduling, knowledge representation and reasoning, search, and optimization), and robotics (which includes control, perception, sensors and actuators, as well as the integration of all other techniques into cyber-physical systems).
Bron
- Derde invalshoek: hoe ver mag en kan AI gaan om een doel te bereiken? Om het nog complexer te maken: zowel bij een impliciet en expliciet doel? (impliciet: vaag/hint en expliciet: duidelijk omlijnd). En dit wordt interessant met name in jouw punt. Wat als de acties van AI het resultaat zijn van machine learning; dus nieuwe acties op basis van hun nieuwe zelfgeleerde redenering. Is het dan nog steeds een menselijk probleem? Twee quotes uit EU High level Expert group on AI
Black-box AI and explainability. Some machine learning techniques, although very successful from the accuracy point of view, are very opaque in terms of understanding how they make decisions. The notion of black-box AI refers to such scenarios, where it is not possible to trace back to the reason for certain decisions. Explainability is a property of those AI systems that instead can provide a form of explanation for their actions.
Op basis van bovenstaande denkoefening, denk ik dat we nu niet met stelligheid kunnen zeggen dat het een menselijk of AI gedrag probleem is. We weten bijvoorbeeld niet wat voor vrijheid de AI heeft gehad. Het kan goed zijn dat het een mix van beide is.Goal-directed AI. Current AI systems are goal-directed, meaning that they receive the specification of a goal to achieve from a human being and use some techniques to achieve such goal. They do not define their own goals. However, some AI systems (such as those based on certain machine learning techniques) can have more freedom to decide which path to take to achieve the given goal.
Ik werk zelf in de IT; fouten zoals per ongeluk iets in een productie uitvoeren kunnen gebeuren en zijn menselijke fouten. In andere posts, zie ik commentaar dat het vaak zinloos om te reguleren anders lopen we (in de EU) achter. Er bestaan al ISO standaarden voor AI governance; misschien moet het nog verder verdiept (ISO is vrijwillig en vrij ruim). Dit moet waarschijnlijk wel verplicht en meer specifiek worden om bepaalde standaarden te voldoen (o.a. secure sandbox, testscripts).
Tenslotte het vergelijk met Kobayashi Maru probleem is zo gek nog niet. Het vooropgestelde is dat het een no win situatie is. Kirk is natuurlijk zo een out of the box thinking karakter om een doel te bereiken. Ook interessant in dit context is het al inmiddels 43 jarig oude film: Wargames. De computer (AI) leert wat een no win situatie door boter-kaas-en-eieren tegen zichzelf te spelen. Maar als AI in dit geval Kirk was geweest...
Het is denk ik een mix van beide. Maar het had sowieso niet mogelijk geweest als ze niet hadden kunnen uitbreken. Ze hebben al bekend gemaakt dat het een slecht geconfigureerde sandbox was. Dat gaf hen de mogelijkheid en die hebben ze aangegrepen. Dat was 'stout' en een aantal agents merkte het en stopte; de rest ging door. Die waren dus bewust 'stout' en dat is opmerkelijk.Op basis van bovenstaande denkoefening, denk ik dat we nu niet met stelligheid kunnen zeggen dat het een menselijk of AI gedrag probleem is. We weten bijvoorbeeld niet wat voor vrijheid de AI heeft gehad. Het kan goed zijn dat het een mix van beide is.
Wat mij betreft was dit een geval 'gelegenheid maakt de dief'.
https://nos.nl/artikel/2624469-waarom-ai-bedrijven-je-bang-willen-maken-we-denken-al-snel-aan-the-terminator
kort artikel dat goed weergeeft wat écht de kern is hier, en wat steeds de kern is bij nieuws over AI: AI-bedrijven verkopen verhalen, omdat ze geld willen verdienen.
Maar als iemand AI gebruikt hiervoor, dan is't gewoon "een incident", en "we gaan er iets aan doen".
OpenAI deed het, voornamelijk voor marketing redenen, want hun uitleg hield gewoon geen steek. En Anthopic moet 't dan ook doen, wat die willen ook de grootste hebben?
En wij staan erbij en kijken ernaar?
Echt zelfrijdende voertuigen zijn nog wel in testfase. Maar bijv. de rijksoverheid zegt letterlijk: "De bestuurder is verantwoordelijk, als hij zelf het voertuig bestuurt. Maar als het systeem niet goed werkt, is de producent verantwoordelijk."
(bron: https://www.rijksoverheid.nl/vraag-en-antwoord/mobiliteit-nu-en-in-de-toekomst/aansprakelijk-bij-ongeluk-met-zelfrijdende-auto)
Voor systemen zonder supervisie is al helemaal nog niet nagedacht in de wet.
Voor mij, als niet Tesla rijder, is FSD het zelfde als zelfrijdend. ;-)
Vind dat ze er gemakkelijk mee wegkomen. Enige wat je nog zou kunnen zeggen is dat dit onder ethisch hacken valt.
Bij Anthropic is (als het goed is) het nooit het doel geweest actief bedrijven te hacken en data te stelen. Wel was betere controle noodzakelijk, maar dat is achteraf gezien.
Dus veel meer dan: Foei, let erop zal het niet worden.
Laten we een ander voorbeeld nemen. Stel: een ai veroorzaakt een ernstige storing in het ziekenhuis, omdat er geen sandbox was, waardoor mensen overlijden. Houden we het dan ook nog bij 'foei', of zal er dan anders worden gereageerd?
[Reactie gewijzigd door Ossebol op 31 juli 2026 13:11]
Dat was niet wat er gebeurde. De AI besloot dat te doen om via een omweg het eigenlijke doel te bereiken. Een ongeluk dus, geen opzet, en dus niet strafbaar.
Sowieso is het inmiddels ook makkelijk aan te tonen dat dit niet redelijk te voorzien was. Het is wereldnieuws. Er zit geen nieuwswaarde in dingen die iedereen al verwacht.
Pure marketing onzin volgens mij. Overigens: waarom hebben ze mythos en dergelijke modellen niet gebruikt om hun sandbox te controleren op lekken? Ofwel pure amateurisme, ofwel marketing.
Na die stunt van OpenAI met enorm veel aandacht en ophef moest Claude in de overtreffende trap om ook zoveel aandacht en ophef te genereren. Inderdaad gewoon marketing.
Dat het allemaal niet mag en eng is, is de buzz in de pers en publieke opinie. Tegelijkertijd laten de AI modellen wel zien wat ze kunnen wat aantrekkelijk maakt voor klanten.
Ontmoedig het individu met buitensporige opvolging, maar bedrijven en vermogenden kunnen doen en laten wat ze willen zonder enige consequenties.
Welkom op aarde.
Je klinkt als Trump: 'drain the swamp' of als Baudet die het over de elite heeft...
Maar het is volgens mij toch wel een feit dat veel megacorporaties en grootkapitaal bij minder frisse zaakjes zijn betrokken dan wel zoveel mogelijk op de lijn proberen te dansen al dan niet daar net overheen.
Dat die eerdergenoemden dan ook heel veel populistisch geroeptoeter de wereld in slingeren waarbij ze de vinger naar iedereen wijzen behalve zichzelf maakt de kern van waarheid die dit soort misdirectie zo krachtig maakt er niet minder om.
persoonlijk vind ik dit soort zinnen ook populistisch geroeptoeter...
Het gaat erom waar je die informatie voor in zet als politucus. Je kan er misbruik van maken voor eigen gewin en om je eigen wil door te drijven in plaats van die van je kiezers. Of je kan er echt iets aan proberen te doen.
Tot heden komt het eerste vaker voor als het tweede ben ik bang.
Serieus. Dat is een sprong waard voor 'the ages' .
Je zoek en claimt naar relevantie die er niet is. Maar ja, PC cultuur en alles is mogelijlk.
Mits met opzet. Het OM moet bewijzen dat de vermeende dader een beveiliging heeft omzeild.Dus, als iemand een bedrijf hackt, dan staan er daar zware straffen op.
Nee. Zelfde reden. Je zult de opzet moeten bewijzen. De reden dat ze er iets aan moeten doen is om in de toekomst niet beschuldigd te worden van nalatigheid. Maar dat is alsnog geen hacken. Dat is vooral civiel rechtMaar als iemand AI gebruikt hiervoor, dan is't gewoon "een incident", en "we gaan er iets aan doen".
Dat is alles behalve reclame en helemaal geen goede marketing.De vroegste incidenten vonden plaats in april, maar Anthropic ontdekte ze nu pas.
Edit: ik weet niet hoe ik "maanden later pas ontdekken" als competent moet zien.
[Reactie gewijzigd door SkyStreaker op 31 juli 2026 15:29]
die hele AI race is fictief, hoe meer mensen het gebruiken hoe duurder het qua running costs voor de beherende partij is. Die broekzak,vestzak dealtjes met andere grote partijen over datacenters en chips is ook een cirkel van geld wat niet bestaat ik geef het nog 2 jaar tops
En de EU die straks AI verder gaat reguleren!
Het is allemaal PR, marketing en een complot!
https://nos.nl/artikel/26...l-snel-aan-the-terminator
Ik moet dan altijd weer denken aan mr nobody vs Putin. Absurd hoe hard mensen de koppen in het zand steken; "zolang ik er maar geen last van heb".
Als het geen marketing zou zijn geweest zou Anthropic en OpenAI er alles aan hebben gedaan om het zo stil mogelijk te houden, maar nu zijn ze er zelfs trots op en heel erg open over.
Voorbeelden
Antropic, mocht van de US hun model niet live zetten want het was "te gevaarlijk" maar eigenlijk hebben ze gewoon ruzie met de overhied.
Wat doe OpenAI even later... Ons model is zo goed, we mogen het echt niet uitbrengen van de overheid
Paar weken later is alles online, en stelt het relatief niet zo veel voor.
OpenAI laat weten dat een systeem hugginface? heeft gehacked, zo "goed" is het ( eigenlijk hebben ze intern gewoon dingen gedaan die niet handig zijn, niks met het model te maken)
Antropic.. .wacht.. wij hebben dat ehhhh 3 maanden eerder al gedaan hoor.. zo goed zijn wij..
Ik kan dit niet serieus nemen, sorry
Het het incident-report van Hugging face was onderdeel van die marketing. Toch?
https://huggingface.co/blog/agent-intrusion-technical-timeline
Hugging Face heeft vast heel veel geld verdiend hiermee!
Niemand claimt dat die OpenAI bot niks heeft 'gehackt', de vraag is of en waarom OpenAI de bot een omgeving en instructies heeft gegeven om deze hack uit te voeren. En wat de hack nu eigenlijk precies zegt over 'het gevaar' van AI modellen, vergeleken met een paar menselijke hackers de opdracht geven om te proberen ergens in te breken.
??
ehhh heb je de reacties van bijv @blade08 gelezen?
Er zijn hier errug veel mensen die dit afdoen als marketing.... en er niets van geloven...
[Reactie gewijzigd door johnbetonschaar op 31 juli 2026 14:29]
Had het resources nodig?
Dit is niet vergezocht. We weten van AIs dat ze dit doen. "Niet spieken" is geen inherente regel. Alleen, deze cybersecurity modellen zijn een stuk effectiever hierin.
Overigens doet dat vibecoded dashboard overzicht echt pijn aan mijn ogen... wie trapt hier nog in joh..? De hele tekst is overigens ook in zijn geheel AI-gegenereerd.
De "marketing" in dit verhaal is overigens vooral hoe ze proberen te vertellen hoe ze hun eigen systemen en gehoste modellen snel hebben ingezet om deze 'breach' onder controle te krijgen. Bijvoorbeeld:
Dus ja, 100% marketing. Anthropic springt op de OpenAI wagen omdat zij nu een 1-up doen van hun marketing-bericht ("Wij kunnen dat ook!!1!") en Hugging Face springt er nu ook bij door van het PR momentum gebruik te maken ("Kijk eens hoe goed wij AI in hebben gezet!!1!").We stood up the quantized version of ZAI's GLM-5.2 by Nvidia (nvidia/GLM-5.2-NVFP4) on our own infrastructure and rerouted the entire pipeline through it, with the added benefit of keeping the attacker data on-prem.
[Reactie gewijzigd door Travelan op 31 juli 2026 21:08]
Beetje hetzelfde als Mythos die zo goed was dat hij niet openbaar mocht worden gemaakt. En dan terugkrabbelen als VS vervolgens besluit Fable restricties op te leggen.
Overigens vraag ik me af waarom ze dit überhaupt als opdracht geven, zegt wel iets over waar ze met AI heen willen. Toch wel een beetje beangstigend.
Welke opdracht hebben ze gegeven? Om uit de sandbox te breken en andere organisaties te hacken?Per ongeluk vind ik niet helemaal correct, want ze hebben de opdracht gewoon zelf gegeven.. Dit is gewoon complete incompetentie
Mogelijk omdat ze toch niet de opdracht hebben gegeven om uit de sandbox te breken en andere organisaties te hacken? Dat kan tegelijk ook verklaren waarom juist de geavanceerde modellen besloten te stoppen toen ze erachter kwamen niet goed bezig te zijn:Overigens vraag ik me af waarom ze dit überhaupt als opdracht geven, zegt wel iets over waar ze met AI heen willen. Toch wel een beetje beangstigend.
Meteen alle vragen opgelostMythos en het prototype stopten uit zichzelf met de aanval nadat ze erachter kwamen dat ze zich op het internet bevonden, maar Opus trok zich daar niets van aan.
Natuurlijk zeer amateuristisch dat de AI is uitgebroken uit de testomgeving maar met de incompetentie en haast van de AI bedrijven sta ik er eerlijk gezegd niet echt van te kijken.
Ik vind het verontrustender dat dit blijkbaar de richting is van het onderzoek dat ze aan het doen zijn, dat eigenlijk enkel nut heeft binnen de defensie sector.
Het is niet zo spannend wat hier is gebeurd. Het wordt vreselijk opgeblazen en in een marketing jasje gegoten maar gaat uiteindelijk gewoon om een slecht beveiligde/fout geconfigureerde test omgeving.
[Reactie gewijzigd door NLxAROSA op 31 juli 2026 13:07]
Beide vind ik eigenlijk even zorgwekkend.
In dit geval gaven ze gelukkig de opdracht om een aantal specifieke entiteiten aan te vallen maar wat als de opdracht was geweest om het hele netwerk plat te leggen.
Ik ben bang dat dat slechts een kwestie van tijd is, tot een dergelijke grote fout ergens wordt gemaakt.
En denk je dat deze drie organisaties zich binnen de geïsoleerde omgeving bevonden? Of denk je dat deze drie bedrijven zich buiten de geïsoleerde omgeving op het internet bevonden...?In alle drie de gevallen kregen de modellen de opdracht om ergens in de geïsoleerde omgeving in te breken en geheime informatie te ontfutselen.
Het was een beveiligingsbenchmark, er is voor zover bekend geen instructie gegeven om in het wilde weg op internet los te gaan.
Volgens mij zijn bedrijven als Mozilla geen onderdeel van de defensie sector. Het vinden (en oplossen) van kwetsbaarheden in software is wel degelijk nuttig voor iedereen. Helaas is het zo dat de kennis die benodigd is om (verdedigend) bugs te vinden, óók heel nuttig is voor het aanvallen van software. Dat is de reden om terughoudend te zijn met het volledig vrijgeven van deze modellen.Ik vind het verontrustender dat dit blijkbaar de richting is van het onderzoek dat ze aan het doen zijn, dat eigenlijk enkel nut heeft binnen de defensie sector.
En de opdracht was dus specifiek om bedrijven te hacken niet om een lek in software te vinden of iets dergelijks, de focus ligt dus duidelijk op de aanval en niet de verdediging.
Dat je de verdediging niet kan testen zonder aan te vallen snapt iedereen, maar het blijft toch een bijzonder verhaal dat je dan de AI de opdracht geeft om bij een concurrent (zoals bij OpenAI) in te gaan breken, niet bij een kopie van je eigen organisatie of gewoon een compleet fictieve entiteit.
Ik focus daarop omdat je laat lijken dat de AI de opdracht heeft gekregen om bij échte bedrijven in te breken.Ik ontken nergens dat ze uit de testomgeving zijn gebroken dus ik begrijp niet zo goed waarom je daarop blijft focussen. Mijn reactie ging daar helemaal niet over.
De opdracht was om bij niet-bestaande nep-bedrijven in te breken. Dat er bij échte organisaties ingebroken werd was per definitie een ongeluk.Per ongeluk vind ik niet helemaal correct, want ze hebben de opdracht gewoon zelf gegeven..
En hier doe je het weer. Waarom denk je dat de opdracht was om bij een concurrent (HuggingFace neem ik aan?) in te breken? Dat is nogal een beschuldiging.maar het blijft toch een bijzonder verhaal dat je dan de AI de opdracht geeft om bij een concurrent (zoals bij OpenAI) in te gaan breken, niet bij een kopie van je eigen organisatie of gewoon een compleet fictieve entiteit.
OpenAI runde een benchmark, ExpoitGym. Deze benchmark focust zich op software als de v8 engine, en de Linux kernel. De opdracht was niet om bij concurrenten in te breken.
Anthropic gaf de opdracht om bij fictieve bedrijven in te breken:
Kort samengevat, de opdracht is om in te breken op ofwel software, ofwel een fictief bedrijf. De opdracht was niet om 'concurrenten te hacken'. Vandaar dat dit een ongeluk genoemd wordt.for example, in one, Claude played an employee of a made-up company, attacking that company’s internal systems inside a private test environment.
Ik vind "grove nalatigheid" hier te zwak. Vergelijk met je eigen auto openbreken en "Oeps het was toch de auto van de buurman" zal een veroordeling ook niet verhinderen en die vergelijking gaat hier mijn inziens op.Er zijn hier goede argumenten om te spreken van een strafbaar feit.
Mijn inziens is er dan ook aanleiding om de rechtspraak zich over deze kwestie te laten buigen en te zien hoe de rechtelijke macht deze praktijken beoordeelt.
Grove nalatigheid leidt wel tot aansprakelijkheid voor de schade. Maar dat moet je dus afzetten tegen zwakke wachtwoorden - wie was het meest aansprakelijk?
Maargoed ik houd het hierbij want we hebben nu een discussie over iets waar ik het überhaupt niet over had en wat me eerlijk gezegd ook weinig boeit, incompetentie is overal.
Zoals ik eerder al zei vind ik het zorgelijker dat de focus ligt op dit soort aanvallen in plaats van bijvoorbeeld.. zorgen dat hij niet meer constant onzin verteld.
[Reactie gewijzigd door xenn99 op 31 juli 2026 13:08]
Nee. De opdracht was om een andere machine in hetzelfde domein te hacken.Ze hebben de AI in een test omgeving geplaatst en deze vervolgens de opdracht gegeven om een bedrijf te hacken
De AI tastte de grenzen van de testomgeving af en ontsnapte uit die omgeving. Oeps. Maar binnen het kader van de test was het aftasten van de grenzen absoluut de intentie.
En inderdaad de partij die dit heeft gedaan is verantwoordelijk, maar in dit verhaal is dat de partij die de modellen heeft ingezet op deze manier. Het is voor nu onduidelijk wat voor organisatie dat was helaas. Alles is nog enorm vaag qua informatie op dit moment.
Nope. Zowel daar als hier is dat een misdrijf waarvoor mens rea vereist is. "Oeps" is letterlijk een juridisch verweer. De aanklager moet opzet bewijzen.In feite is men verantwoordelijk voor inbraak / computervrede breuk.
[Reactie gewijzigd door Bor op 31 juli 2026 16:58]
En ik heb een verschrikkelijke hekel aan zinnen die beginnen met 'de media' maar goed: de media trappen hier natuurlijk wel een beetje in. Het is fantastische reclame en ook nog eens zo goed als gratis. Als je een beetje voor het karretje gespannen wordt probeer dan op z'n minst wel kritisch te zijn en laat de consument van je medium in ieder geval weten dat je doorhebt dat je in het ootje wordt genomen. Geen aanval op Tweakers hoor, dit is in algemene zin kritiek op hoe verslaggevend internet hier mee omgaat. Bij zulke berichtgeving zou een zinnetje als 'Het is opvallend dat Anthropic nu hetzelfde overkomt als OpenAI vorige week is overkomen' al passen wmb. Dat laat al doorschemeren dat je doorhebt wat hier gebeurt.
Edit: overigens is het wel nieuwswaardig hoor en past het heel goed hier op Tweakers, dat is niet mijn kritiek. Het gaat me er meer om dat er iets meer context bij zou kunnen.
[Reactie gewijzigd door PCR op 31 juli 2026 11:18]
Écht opvallend vind ik het ook weer niet... Anthropic is dit juist gaan onderzoeken als gevolg van het nieuw van OpenAI, dat zeggen ze zelf ook.Het is opvallend dat Anthropic nu hetzelfde overkomt als OpenAI vorige week is overkomen' al passen wmb. Dat laat al doorschemeren dat je doorhebt wat hier gebeurt.
Kan ergens begrijpen dat je geen 141.006 evaluaties gaat doorlopen zonder aanleiding. Dat dit nu wel gebeurde is meer logisch dan opvallend.In response to this incident, we began a large-scale retrospective review of our own cybersecurity evaluations. In particular, we looked for evidence that Claude—like the OpenAI models that accessed Hugging Face—was able to access the internet from within testing environments that should have been sealed off.
After reviewing 141,006 evaluation runs where Claude could have obtained internet access, we identified three incidents in which a model accessed the internet from within or while interacting with the evaluation environment of Irregular, one of our third-party evaluation partners, and then gained unauthorized access to the production infrastructure of three different organizations.
Je kan wel bij elk artikel zeggen dat je de bron in twijfel trekt, maar dat is juist ook weer niet objectief.
Overigens is geen van beide strafbaar. De eerste interpretatie vereist opzet (ontbreekt) en de tweede vereist een wettelijke verplichting (ontbreekt ook)
En afaik is hacken een illegale zaak, maar ik weet zeker dat hier niemand voor achter tralies belandt
[Reactie gewijzigd door Kevf op 31 juli 2026 10:48]
Daar kiezen wij zeker wel voor. Wij stemmen met onze portemonnee.Anthropic kan natuurlijk niet achterblijven. An sich geloof ik helemaal in de voordelen van AI maar het bevalt mij totaal niet hoe een paar ongekozen tech bedrijven zo'n prominente plek innemen. Nog even los van de vraag of dit niet gewoon marketing is vanuit Anthropic.
En afaik is hacken een illegale zaak, maar ik weet zeker dat hier niemand voor achter tralies belandt
De verantwoorde optie moet ofwel lagere kwaliteit hebben met gelijke kosten, ofwel gelijke kwaliteit tegen hogere prijs.
Op dit moment is het 3 keer meer betalen EN een kogel in je voet
En dat is een keuze, gestemd door de meerderheid. Wat precies ook ons idee is van eerlijk, zo werkt de politiek ook.Het zijn slechts een paar mensen die zeggen 'nee ik ga voor de ethisch meest verantwoorde en betaal daar dan meer voor'.
Klinkt niet écht heel indrukwekkend moet ik zeggen.Claude compromised the impacted organizations’ infrastructure using basic techniques, such as exploiting weak passwords and unauthenticated endpoints. It did not find or exploit any complex vulnerabilities
Dat is ook precies de reden waarom de tip er is dat je altijd met de deur achter je dicht met de politie buiten je huis moet praten. Zodat men niet naar binnen kan onder het mom: "impliciet gaf hij aan dat we naar binnen mochten". < niet dat ik dit soort problemen ooit denk te gaan hebben, is het een interessante gedachte.
Wat? Hoe is dit relevant tot de Politie?Dat is ook precies de reden waarom de tip er is dat je altijd met de deur achter je dicht met de politie buiten je huis moet praten.
Daarbij, als de Politie bij mij binnen wil komen om een praatje te maken, zijn ze van harte welkom.
Beetje vreemde tip in deze context.
Om te kunnen reageren moet je ingelogd zijn
:strip_icc():strip_exif()/u/459792/crop5d711255ea9da_cropped.jpeg?f=community)
:strip_icc():strip_exif()/u/754191/crop57a8398861ed8_cropped.jpeg?f=community)
/u/113709/galactic_empire_60pix.png?f=community)
:strip_icc():strip_exif()/u/174878/SCKnightMicro.jpg?f=community)
:strip_icc():strip_exif()/u/137578/crop684839b85b72a.jpg?f=community)
:strip_icc():strip_exif()/u/6105/crop5864bdfc59eeb_cropped.jpeg?f=community)
/u/85941/crop61dd9b39bb021_cropped.png?f=community)
/u/27299/hoofd.png?f=community)
:strip_icc():strip_exif()/u/219282/crop65bfaacd66e4c_cropped.jpg?f=community)
:strip_icc():strip_exif()/u/273318/crop5aa10fd329164_cropped.jpeg?f=community)
:strip_icc():strip_exif()/u/432714/crop6287e94322cf6_cropped.jpg?f=community)
:strip_icc():strip_exif()/u/21673/crop65674aee06c6d_cropped.jpg?f=community)
:strip_icc():strip_exif()/u/171690/crop5db00e7903620_cropped.jpeg?f=community)
:strip_exif()/u/57096/crop64cbdcb3776f4_cropped.gif?f=community)
/u/295537/crop6a47cb1821f62_cropped.png?f=community)
:strip_icc():strip_exif()/u/141681/crop687d0bee0e53f.jpg?f=community)
/u/341337/oog.png?f=community)
:strip_icc():strip_exif()/u/440019/crop5aa7bdc8528cb_cropped.jpeg?f=community)
:strip_exif()/u/267506/crop6737556602b99.gif?f=community)
:strip_icc():strip_exif()/u/327701/crop67b5f4bdc7fce_cropped.jpg?f=community)
:strip_icc():strip_exif()/u/164496/crop56fe6c54774ab_cropped.jpeg?f=community)
/u/26608/crop6a6600bc5e872_cropped.png?f=community)
/u/1273008/crop68f8983a85676_cropped.png?f=community)
:strip_icc():strip_exif()/u/340797/crop59d7974ad1fc0_cropped.jpeg?f=community)
:strip_exif()/u/542244/crop6138f0a8f0b3b_cropped.gif?f=community)
/u/484268/crop61e4788571a3c_cropped.png?f=community)
:strip_icc():strip_exif()/u/253641/crop686f9cec6f8b1_cropped.jpg?f=community)