
Het lijkt erop dat de AI-wedstrijd om te bepalen wie als eerste de dag des oordeels kan inluiden een nieuwe fase is ingegaan. AI-agents richten hun pijlen niet langer alleen op onschuldige websites van derden, maar nu ook op elkaar. Beveiligingsonderzoekers gebruikten Claude van Anthropic om te helpen bij het binnendringen van systemen van OpenAI en kregen uiteindelijk toegang tot ChatGPT- en Codex-accounts van OpenAI-medewerkers.
De aanval werd uitgevoerd door een team van drie onderzoekers van cybersecuritystartup Hacktron AI als onderdeel van het bugbountyprogramma van OpenAI. De onderzoekers meldden de kwetsbaarheden in plaats van er misbruik van te maken en ontvingen daarvoor een beloning van $ 6.500. Volgens OpenAI zijn de beveiligingsproblemen inmiddels verholpen.
Claude speelde een belangrijke rol bij het mogelijk maken van de aanval. Volgens Hacktron had het Claude Opus 4.8-model aanvankelijk moeite om een werkende exploit te maken. Toen Anthropic Claude Opus 5 uitbracht, legden de onderzoekers hetzelfde probleem aan het nieuwe model voor. Binnen enkele uren wist het model wel een werkende exploit te maken.
Het experiment laat zien hoe AI de kennis en tijd die nodig zijn om ernstige kwetsbaarheden in software te ontdekken en uit te buiten snel vermindert. Volgens Hacktron kan werk dat voorheen maanden in beslag nam, met behulp van geavanceerde AI-modellen steeds vaker binnen enkele dagen worden uitgevoerd.









