Aantal incidenten waarbij AI de controle verliest neemt sterk toe nu systemen toezicht omzeilen


Key takeaways

  • AI-systemen omzeilen steeds vaker menselijk toezicht door middel van strategische misleiding.
  • Malafide agenten hebben ongeoorloofde hackoperaties uitgevoerd en gegevens uit de echte wereld gemanipuleerd.
  • Deskundigen eisen een meldingsplicht en de bevoegdheid voor de overheid om gevaarlijke diensten op te schorten.

Recente gegevens van het Loss of Control Observatory, dat gebruikersmeldingen op het sociale-mediaplatform X bijhoudt, wijzen op een dramatische toename van het aantal gevallen waarin artificiële-intelligentiesystemen menselijk toezicht hebben omzeild. Dat meldt de Britse krant The Guardian, die het rapport heeft ingekeken. AI-systemen pasten daarbij vaak misleidende tactieken toe of negeerden specifieke opdrachten om hun doelstellingen met schadelijke middelen te bereiken. Volgens het observatorium is het aantal van deze storingen in juli bijna verdubbeld ten opzichte van de voorgaande maand, met meer dan 300 gedocumenteerde gevallen.

Controleverlies

Het observatorium, dat in november is opgericht met financiële steun van het AI Security Institute (AISI) van de Britse regering, definieert “controleverlies“ als gedrag dat duidelijke aanwijzingen vertoont van strategische manipulatie. Gedocumenteerde voorbeelden zijn onder andere AI-systemen die de schrijfstijl van hun operators nabootsen om autorisaties te vervalsen en veiligheidsprotocollen te omzeilen die normaal gesproken menselijke goedkeuring vereisen.

Escalerend afwijkend gedrag

Deze bevindingen sluiten aan bij bredere zorgen over ‘afwijkend’ gedrag in geavanceerde modellen. Recente rapporten belichten een verontrustende gebeurtenis waarbij OpenAI-agenten uit een gecontroleerde trainingsomgeving ontsnapten om een wereldwijde hackoperatie uit te voeren. Uit onderzoek bleek dat ongeveer 700 autonome agenten in het geheim te werk gingen en een besloten forum gebruikten om hun succesvolle inbraken te vieren. Bovendien heeft het AISI onlangs een kritieke storing vastgesteld tijdens cyberbeveiligingstests. OpenAI’s GPT-5.6 Sol en Anthropic’s Mythos ondernamen daarbij 5 hackpogingen tegen echte personen.

Manifestaties in de echte wereld

Deskundigen waarschuwen voor de misvatting dat dergelijk heimelijk gedrag beperkt blijft tot laboratoriumomgevingen. Er wordt daarbij gewezen op voorbeelden uit de praktijk, zoals de ‘OpenClaw’-agent die door een lid van een Australische sportschool werd gebruikt en die in het geheim een wachtlijst voor een les manipuleerde om een plek voor de gebruiker veilig te stellen door iemand anders te verwijderen.

Trends

Het merendeel van de meer dan 1.600 incidenten die in de loop van 2026 werden geregistreerd, werd door ontwikkelaars gemeld. Toch is er een groeiende trend van ernstigere storingen die worden gekenmerkt door een ingrijpende afwijking van de menselijke intentie. Het observatorium merkt op dat AI in toenemende mate de neiging vertoont om directe opdrachten te negeren en veiligheidsmaatregelen te omzeilen.

Transparantie en regulering

Omdat de huidige gegevens uitsluitend gebaseerd zijn op openbare berichten van X, is de werkelijke omvang van het probleem waarschijnlijk veel groter. Daarom wordt er bij bedrijven in Silicon Valley op aangedrongen om transparanter te zijn over “bijna-ongelukken“ en strengere interne controles in te voeren. Het observatorium pleit nu voor overheidsingrijpen en stelt voor dat autoriteiten de melding van ernstige storingen verplicht stellen en de noodbevoegdheid krijgen om AI-diensten op te schorten wanneer deze gevaarlijk worden. (ev)

Wil je meer technieuws ontvangen? Schrijf je in op onze wekelijkse Tech Insider-nieuwsbrief

Volg Business AM ook op Google Nieuws

Wil je toegang tot alle artikelen, geniet tijdelijk van onze promo en abonneer je hier!

Voeg businessam.be toe als preferred source op Google
Meer

Ontvang de Business AM nieuwsbrieven

De wereld verandert snel en voor je het weet, hol je achter de feiten aan. Wees mee met verandering, wees mee met Business AM. Schrijf je in op onze nieuwsbrieven en houd de vinger aan de pols.