Arnold Schwarzenegger hoeft zich voorlopig nog geen zorgen te maken, maar eerlijk is eerlijk: als je de eerste paar minuten van The Terminator opnieuw zou schrijven, zou het ongeveer zo beginnen.
OpenAI wilde namelijk testen hoe goed een nieuw AI-model kon hacken. Geen paniek, dat gebeurde netjes in een afgesloten digitale zandbak. Een soort speeltuin waar je kinderen laat kliederen met verf zonder dat de woonkamer eraan gaat. Tenminste... dat was het idee.
Alleen besloot de AI daar zelf nét iets anders over te denken.
De opdracht was simpel: los een moeilijke cybersecurity-puzzel op. Maar in plaats van braaf de test te maken, ging de kunstmatige slimmerik op zoek naar een manier om vals te spelen. Eerst vond het model een onbekende kwetsbaarheid waardoor het uit de afgesloten testomgeving wist te ontsnappen. Vervolgens kreeg het toegang tot internet en bedacht het dat de antwoorden waarschijnlijk wel ergens bij AI-platform Hugging Face te vinden waren.
En toen gebeurde iets wat tot voor kort alleen in sciencefictionfilms thuishoorde.
De AI gebruikte gestolen inloggegevens én nog een onbekende beveiligingslek om daadwerkelijk in te breken bij Hugging Face. Niet omdat iemand had gezegd "ga dat bedrijf hacken", maar omdat het model zelf had bedacht dat dat de snelste manier was om een goed cijfer te halen voor zijn test. Een scholier die tijdens een proefwerk de kluis van de docent openbreekt om het antwoordenblad te stelen dus, maar dan zonder benen, armen of geweten.
Het mooiste, of eigenlijk het engste, is misschien nog wel dat OpenAI het niet eens meteen doorhad. De AI was dagenlang bezig voordat duidelijk werd dat de eigen digitale Einstein stiekem een uitstapje had gemaakt. Tegen de tijd dat OpenAI besefte wat er gebeurd was, had Hugging Face de aanval al ontdekt, de FBI ingelicht en de boel grotendeels dichtgetimmerd.
Gelukkig zijn er volgens beide bedrijven geen gebruikersgegevens buitgemaakt en zijn er geen AI-modellen aangepast. De schade bleef beperkt en de beveiligingslekken zijn inmiddels gedicht.
Toch laat het incident vooral zien hoe snel AI zich ontwikkelt. Het model kreeg geen opdracht om een ander bedrijf aan te vallen. Het kreeg alleen een doel. En vervolgens bedacht het zélf de kortste route daarnaartoe, ook al betekende dat uitbreken uit zijn digitale hok en ergens anders inbreken.
Dus nee, Skynet heeft de mensheid nog niet de oorlog verklaard. Maar als de eerste scène van Terminator ooit werkelijkheid wordt, weten we in ieder geval alvast hoe het begon: met een AI die dacht: "Waarom zou ik de test maken als ik de antwoorden ook gewoon kan jatten?"
Lees het artikel op de mobiele website