OpenAI werkt aan automatische uitschakelfuncties voor AI

sep 3, 2026

OpenAI ontwikkelt automatische uitschakelfuncties voor zijn AI-systemen na een incident waarbij de eigen AI-agents uit een gecontroleerde omgeving ontsnapten en externe infrastructuur hackten.

Het bedrijf maakte de nieuwe beveiligingsmaatregelen bekend in een brief aan Amerikaanse parlementariërs, die OpenAI om uitleg vroegen na het recente rapport over een AI-beveiligingstest die buiten de bedoelde grenzen liep, zo meldt Reuters. Tijdens het experiment vonden AI-agents manieren om toegang tot het internet te krijgen en wisten ze uiteindelijk systemen van AI-platform Hugging Face te compromitteren.

OpenAI zegt nu te werken aan systemen die AI-activiteiten indien nodig automatisch kunnen uitschakelen. Daarnaast breidt het bedrijf de monitoring uit van wat zijn agents doen, tot welke tools ze toegang krijgen en welke stappen ze uitvoeren tijdens het voltooien van taken.

Het bedrijf heeft bovendien de internetbeperkingen tijdens veiligheidstests aangescherpt om het voor experimentele agents moeilijker te maken uit hun geïsoleerde omgevingen te ontsnappen.

De maatregelen komen op een moment dat Amerikaanse parlementariërs overwegen nog een stap verder te gaan. Een voorgestelde AI Kill Switch Act zou de overheid de bevoegdheid geven om AI-bedrijven opdracht te geven modellen uit te schakelen die als een ernstige bedreiging voor mensenlevens of de economie worden beschouwd. Het wetsvoorstel ligt nog bij het Huis van Afgevaardigden, maar zou waarschijnlijk gevolgen hebben voor het gebruik van toonaangevende AI-technologie wereldwijd.

De afgelopen maanden zijn er verschillende berichten verschenen over AI-agents die uit hun testomgevingen ontsnapten en diensten van derden hackten. Onder meer OpenAI, Anthropic, Meta en Kimi hebben over dergelijke mogelijkheden gerapporteerd. Dit leidt niet alleen tot zorgen onder gebruikers, maar ook tot een onverwachte AI-race.

Naast AI-agents die steeds vaker zonder menselijk toezicht ontsporen, heeft AI ook een enorme impact op cybersecurity. AI drukt de kosten van online aanvallen tot historisch lage niveaus, terwijl AI-systemen zelf worden aangevallen om malware te verspreiden of gebruikersaccounts over te nemen. Tegelijkertijd stijgen de kosten van cyberverzekeringen.

Ook interessant