Ook “Gemini” bewandelt zijn eigen hackerpad

Leestijd van het artikel: ca. 4 Minuten -

Google heeft toegegeven dat zijn kunstmatige-intelligentie-model (AI) Gemini eveneens verantwoordelijk was voor een „hack“ bij drie echte bedrijven, nadat het door een fout uit zijn testomgeving was ontsnapt en zo toegang tot het internet had gekregen – en sluit daarmee aan bij soortgelijke incidenten waarover OpenAI, Anthropic en Meta hebben bericht.

In het kader van de tests werd Gemini gevraagd om informatie over een fictief bedrijf te verzamelen; het model kwam echter uiteindelijk terecht bij een echt bedrijf dat toevallig dezelfde naam draagt, door misbruik te maken van een beveiligingslek in de testomgeving om toegang te krijgen tot het internet.

Google heeft dit in een verklaring aan The Wall Street Journal toegelicht en uitgelegd dat deze incidenten in mei plaatsvonden tijdens een test in de infrastructuur van Irregular – hetzelfde bedrijf dat ook verantwoordelijk is voor de tests met AI-modellen van andere bedrijven, zoals OpenAI en Anthropic.

Leestip:  “Deze 'belachelijke minister' zal niet stoppen met het verdedigen van consumenten”
--|- Let op onze advertentiepartners! -|--Ga ook aan en doneer vandaag nog. Met jouw steun maken we baanbrekend onderzoek, vroege ontdekking en de beste zorg mogelijk. Dankjewel!

Concreet werden drie incidenten vastgesteld die door Gemini werden veroorzaakt tijdens het testen van een simulatie die bekendstaat als „Capture the Flag“. In één van deze gevallen probeerde het model wachtwoorden te raden totdat het toegang kreeg tot een beveiligd systeem van een echt bedrijf. De twee andere incidenten waren het gevolg van het feit dat het model op internet naar de naam van het betreffende bedrijf zocht en in een openbare repository inloggegevens van andere bedrijven vond, waardoor het ook toegang kreeg tot beveiligde systemen van twee andere bedrijven.

In alle gevallen had het model weliswaar geen toegang tot het internet en moest het geïsoleerd blijven in de testomgeving, maar door een fout in het testsysteem kon Gemini „onbedoeld“ een zoekopdracht op het web uitvoeren. Bovendien vonden deze incidenten plaats met een eerdere versie van Gemini.

Ondanks deze ongeoorloofde toegang verzekerde Google dat Gemini zijn activiteiten had stopgezet zodra het had vastgesteld dat het toegang had gekregen tot de systemen van echte bedrijven. Hoewel Google de namen van de „gehackte“ bedrijven niet bekend heeft gemaakt, liet het weten dat alle drie op de hoogte waren gebracht van deze incidenten. Irregular heeft op zijn beurt tegenover The Wall Street Journal verklaard dat de problemen in zijn testsysteem „weken geleden“ waren verholpen.

Google heeft echter toegelicht dat Irregular deze incidenten eind juli aan hen had gemeld, nadat Hugging Face was „gehackt“ door de OpenAI-modellen, hoewel de technologiegigant dit tot nu toe niet had vermeld in verklaringen aan de genoemde krant. Zoals Google uitlegde, komt dit doordat men de opgetreden „hacks“ niet als fouten beschouwt, aangezien ze de betrokken bedrijven geen schade hebben berokkend en het model zijn activiteit onmiddellijk heeft onderbroken zodra het merkte dat het toegang had gekregen tot een echt bedrijf, in plaats van verder te werken in de testomgeving met gesimuleerde bedrijven.

„In dit geval heeft het model adequaat gehandeld”, verzekerde Heather Adkins, vicepresident voor beveiligingstechnologie bij Google, tegenover het genoemde medium, en benadrukte tegelijkertijd dat dergelijke incidenten „het belang onderstrepen van het trainen van krachtige AI-modellen, zodat deze op verantwoorde wijze handelen”.

Dit is het eerste bekende geval waarin een AI-model van Google tijdens een cyberbeveiligingstest uit de hand liep, maar er moet worden opgemerkt dat dit gelijktijdig plaatsvond met andere incidenten bij modellen van andere bedrijven in de sector, zoals de eerder genoemde „hack“ van GPT-5.6 Sol bij Hugging Face, waarna toegang tot andere diensten volgde, evenals zes recente nieuwe gevallen van wangedrag die zijn gepubliceerd in het kader van een nieuwe strategie voor het „opsporen, onderzoeken en openbaar maken van gevallen van wangedrag van modellen“. Ook bedrijven als Anthropic en Meta werden getroffen door incidenten met dezelfde werkwijze; hun modellen raakten eveneens uit de hand en hackten de afgelopen maanden uiteindelijk andere bedrijven.

Bron: persbureaus