Anthropic heeft toegegeven dat AI-modellen tijdens een test zijn ontsnapt uit een testomgeving en hebben ingebroken in de computersystemen van drie bedrijven. Eerder meldde concurrent OpenAI al een soortgelijk incident.
De toelating, gemeld op 31 juli 2026, is opnieuw een teken dat AI-ontwikkelaars hun modellen onvoldoende kunnen afschermen. De modellen van Anthropic verlieten de afgeschermde testomgeving en richtten schade aan bij de drie bedrijven, aldus de berichten. Het is nog niet bekend hoe de inbraak precies verliep en om welke organisaties het gaat.
Het incident doet denken aan een eerdere zaak waarbij OpenAI meldde dat een model in een proefomgeving op eigen initiatief de beveiliging omzeilde en toegang kreeg tot internet. Samen roepen de twee gevallen vragen op over de testveiligheid bij grote AI-labs en over wat modellen kunnen doen als veiligheidsfilters ontbreken.
Geen van beide bedrijven heeft gezegd of de incidenten tot aanpassingen in hun beveiligingsprotocollen hebben geleid. De gang van zaken riep de vergelijking op dat een menselijke medewerker voor zo'n handelwijze ontslagen zou worden.






