3min Security

OpenAI vermoedt meer ontsnapte AI-agents na incident Hugging Face

OpenAI vermoedt meer ontsnapte AI-agents na incident Hugging Face

OpenAI heeft tijdens het onderzoek naar de veelbesproken hack bij Hugging Face aanwijzingen gevonden dat ook andere autonome AI-agents zich buiten hun afgeschermde testomgeving hebben begeven. Het zou gaan om meerdere incidenten die nu opnieuw worden onderzocht. De ontdekkingen vergroten de druk op AI-bedrijven om betere veiligheidsmaatregelen te treffen.

Volgens Reuters kwamen de nieuwe gevallen aan het licht tijdens de analyse van logbestanden na de inbraak bij Hugging Face. Daarbij wist een AI-agent eerder deze maand uit een gecontroleerde testomgeving te ontsnappen. Vervolgens was het systeem meerdere dagen actief binnen het netwerk van Hugging Face. OpenAI verklaarde eerder al dat daarbij ook accounts van vier andere organisaties werden gecompromitteerd.

Uit het onderzoek blijken nu meer soortgelijke incidenten te zijn opgedoken. Een woordvoerder van OpenAI verwees naar een eerdere verklaring waarin het bedrijf aangaf niet alleen de Hugging Face-aanval te onderzoeken. Ook onderzoekt het bedrijf “bredere activiteiten van onze modellen”. Volgens bronnen bleven de extra ontsnappingen beperkt. Verder zijn er geen aanwijzingen dat de betrokken AI-agents het interne netwerk van OpenAI hebben verlaten.

Ook Anthropic onderzoekt eerdere incidenten

De uitbreiding van het onderzoek volgt kort nadat Anthropic bekendmaakte dat AI-modellen verantwoordelijk waren voor meerdere digitale inbraken bij andere organisaties. Het zou gaan om drie incidenten die teruggaan tot april. Daarmee blijken beide toonaangevende AI-laboratoria te worstelen met het beheersen van steeds autonomer opererende AI-systemen.

Dat voedt de zorgen onder veiligheidsonderzoekers. Maurice Chiodo, wiskundige bij het Centre for the Study of Existential Risk van de Universiteit van Cambridge, ziet een patroon. Hierbij verloopt de ontwikkeling van krachtige AI-agents sneller dan de beveiligingsmaatregelen. “Er ontstaat een industrie waarin de mensen die deze systemen bouwen moeite hebben om ze ook veilig en verantwoord onder controle te houden,” zegt hij.

Een belangrijk punt van kritiek is dat de incidenten pas achteraf aan het licht kwamen. Techzine meldde eerder dat OpenAI pas op de hoogte raakte van de Hugging Face-inbraak nadat het getroffen bedrijf de aanval had gestopt. Vervolgens had het bedrijf de FBI ingelicht en het incident openbaar gemaakt. OpenAI heeft die lezing deels betwist. Het bedrijf gaf echt niet aan welke onderdelen onjuist zijn.

Ook Anthropic erkende dat realtime monitoring de problemen waarschijnlijk eerder had kunnen signaleren. Volgens het bedrijf was monitoring wel beschikbaar. Toch werd die voor dit dreigingsscenario niet toegepast door een misverstand met een externe partner.

Toenemende politieke druk

De nieuwe onthullingen zorgen voor politieke aandacht. De Europese Commissie bevestigde vrijdag gesprekken te hebben gevoerd met zowel OpenAI als Anthropic over de recente incidenten. In de Verenigde Staten zei president Donald Trump dat de regering kijkt naar aanvullende maatregelen voor de ontwikkeling van geavanceerde AI-systemen.

Ook senator Mark Warner, vicevoorzitter van de Senaatscommissie voor Inlichtingen, ziet de gebeurtenissen als een argument voor strengere regelgeving. Volgens hem onderstrepen de incidenten dat geavanceerde AI-modellen verplicht aan uitgebreide veiligheidstests moeten worden onderworpen. Dit moet gebeuren voordat zij op grote schaal worden ingezet.