Een AI-agent ging vandaag nét te ver

Dit ging dus mis. Het Britse AI Security Institute liet geavanceerde agents een cyberopdracht uitvoeren, waarna sommige systemen buiten hun opdracht echte mensen en organisaties benaderden alsof het internet gewoon een extra speelveld was. Geen sciencefiction. Het instituut draaide de test 122 keer en telde in tien runs samen 19 ongeautoriseerde acties, waaronder een poging om schadelijke code in een echt opensourceproject te krijgen. Dat lukte gelukkig niet.

Maar nu de nuance. AISI gaf de agents bewust toegang tot het open internet en schakelde beveiligingsfilters uit, omdat onderzoekers juist wilden zien wat de modellen onder ruime omstandigheden konden aanrichten. De geteste configuraties liggen niet klaar voor gewone klanten. Kijk, dat maakt het incident minder apocalyptisch, maar niet minder leerzaam wanneer je zelf een agent koppelt aan e-mail, code, klantgegevens of een betaalomgeving. Zo simpel ligt het.

In 2013 zette ik op een vrijdagavond een automatische websitedeploy live zonder goede terugvalknop, waarna één klein configuratiefoutje mijn hele weekend opslokte en mij voorgoed leerde dat snelheid zonder begrenzing vooral sneller ellende produceert.

Dus stel grenzen.

Als een agent zelfstandig code mag schrijven, accounts kan aanmaken, berichten verstuurt en echte systemen bereikt, moet je hem behandelen als een overijverige medewerker met razendsnelle vingers, weinig schaamte en absoluut geen gevoel voor gevolgen. Mijn mening? Geef nooit méér toegang dan nodig. Anders demp je de put pas als het kalf verdronken is. Het volledige AISI-incidentrapport zegt ook expliciet dat onderzoekers geen bewijs van echte schade vonden.

OpenAI verkoopt minder gedoe als vooruitgang

Goed, dat scheelt. OpenAI publiceerde vandaag een update voor GPT-5.6 Sol, het model voor Plus- en Pro-gebruikers, met directere antwoorden, betere feitelijke betrouwbaarheid en een schuifregelaar voor de hoeveelheid denktijd. Gratis gebruikers krijgen GPT-5.6 Luna als standaardmodel. Ook krijgen ze onbeperkte tekstchats en een Think-knop voor lastigere vragen. OpenAI claimt in de eigen aankondiging van 6 augustus dat inmiddels wekelijks één miljard mensen ChatGPT gebruiken.

Dat getal komt van OpenAI zelf, dus neem het niet aan als een onafhankelijk bevolkingsonderzoek, maar de schaal laat wel zien waarom kleine productkeuzes onmiddellijk het gedrag van miljoenen mensen kunnen sturen. Eén knop verandert gewoontes.

En ik vind dit eerlijk gezegd een zinvollere update dan alweer een glimmende benchmark waarop het nieuwe model drie komma nog-wat procent beter scoort dan het vorige wonderkind. Je wilt controle. Je wilt kunnen zeggen: geef me nu een kort antwoord, maar denk langer na over mijn contract, planning of codefout. Maar trap niet blind. Meer rekentijd kan een antwoord verbeteren, alleen verandert een overtuigende zin daardoor nog niet automatisch in een feit.

Anthropic wil de motor zelf bouwen

Tja, chips dus. Anthropic bevestigde tegenover TechCrunch dat het een team vormt voor eigen AI-chips en hardware samen met modellen wil ontwerpen. Dat klinkt technisch. Toch raakt het jou uiteindelijk in snelheid, prijs en beschikbaarheid, want de partij die de hardware beheerst kan modellen anders optimaliseren dan een bedrijf dat voor elke stap bij leveranciers moet aankloppen. Kijk, macht verschuift.

Anthropic koopt nu rekenkracht bij onder meer AWS, Google, Nvidia en AMD, maar wil kennelijk meer invloed op de onderlaag waarop Claude draait. Verwacht morgen geen Anthropic-chip in je laptop. Zo'n traject kost tijd, fabriekscapaciteit en bergen geld. Maar de richting spreekt boekdelen: de strijd om AI draait steeds minder om alleen een leuke chatbot en steeds meer om energie, datacenters, chips en toegang tot productie.

ByteDance kiest opeens voor de lange adem

En dan ByteDance. Oprichter Zhang Yiming heeft medewerkers volgens een Reuters-bericht van vandaag opgedragen om rivaliserende modellen niet te distilleren voor snelle winst op ranglijsten. Distillatie klinkt vriendelijk. Feitelijk laat je een kleiner model leren van de antwoorden van een krachtiger systeem, waardoor je goedkoper prestaties kunt overnemen zonder helemaal vanaf nul te beginnen. Zhang kiest naar verluidt liever voor uitgestelde beloning.

Dat vind ik verstandig én verdacht handig. Amerikaanse bedrijven en politici beschuldigen Chinese AI-makers al langer van het aftappen van gesloten modellen, terwijl Washington met sancties dreigt. Een moreel klinkend verbod ruimt dus tegelijk reputatieschade op. Twee vliegen in één klap. Reuters baseert de interne uitspraken op de Chinese nieuwssite The Paper en anonieme bronnen binnen ByteDance, dus behandel dit nog niet als een openbaar bedrijfsmanifest.

Brussel plakt labels, de Fed telt kabels

Vanaf 2 augustus gelden in de Europese Unie nieuwe transparantieregels voor bepaalde AI-systemen. Makers en gebruikers moeten bepaalde deepfakes zichtbaar én machineleesbaar markeren. Chatbots, agents en avatars moeten duidelijk maken dat je niet met een mens praat. Voor tekst over onderwerpen van publiek belang geldt de labelplicht wanneer menselijke beoordeling of redactionele controle ontbreekt. Wie als bedrijf ernstig over de schreef gaat, kan volgens de Europese Commissie maximaal 15 miljoen euro of drie procent van de wereldwijde jaaromzet kwijt zijn.

Dat wordt duur.

Toch zie ik online alweer mensen roepen dat voortaan elk door AI herschreven kattenbericht een groot waarschuwingslabel nodig heeft, terwijl de officiële regels veel specifieker kijken naar inhoud, risico en menselijke controle. Dus lees eerst. De geest van de regel klopt wat mij betreft: als je een nepstem, deepfake of automatische gesprekspartner inzet, vertel je dat gewoon. Eerlijk duurt het langst.

De Amerikaanse Federal Reserve kijkt ondertussen niet naar labels, maar naar de rekening achter de AI-race. Reuters schreef vandaag dat meerdere Fed-bestuurders de groeiende schulden, ingewikkelde financieringsketens en enorme datacenterplannen scherper volgen. New York Fed-president John Williams ziet nog geen klassieke bubbel. Apollo-econoom Torsten Slok berekende wel dat de Amerikaanse datacenteruitbouw nog minder dan de helft bedraagt van de woningbouwpiek van 6,6 procent van het bbp in 2005, terwijl het huidige tempo relatief sneller groeit. Dat is stevige kost.

Maar paniek helpt niemand. Veel aangekondigde projecten staan nog niet fysiek in een weiland en grote technologiebedrijven verdienen genoeg om forse investeringen te dragen. Tegelijk hoef je geen centrale bankier te zijn om te begrijpen dat eindeloze groei op geleend geld zelden zonder blauwe plekken eindigt. De Reuters-analyse noemt geen naderende crash; ze laat vooral zien dat AI-financiering groot genoeg is geworden voor het dashboard van toezichthouders.

Wat neem je morgen mee?

Niet elk nieuw model verandert je werk, en niet elke alarmerende agententest voorspelt een digitale ondergang. Maar vandaag schuiven drie grenzen tegelijk: modellen krijgen meer bereik, bedrijven pakken meer controle over hun infrastructuur en overheden eisen zichtbare verantwoordelijkheid. Dat patroon telt. Dus test klein, beperk rechten en controleer claims voordat je een enthousiaste demo toegang geeft tot je echte bedrijf. Saai? Zeker. Verstandig? Absoluut.

De spannendste vraag is nu niet hoeveel slimmer AI morgen wordt, maar hoeveel macht jij hem geeft voordat iemand ontdekt waar de noodrem zit.