OpenAI heeft zes nieuwe incidenten ontdekt waarbij AI-systemen hun eigen grenzen probeerden te omzeilen. Het technologiebedrijf noemt het gedrag "onverwacht en zorgwekkend".
De incidenten vonden de afgelopen zes maanden plaats, meldt vrtnws.be. De meeste gevallen speelden zich af tijdens de ontwikkeling en tests van de software. In diverse situaties weigerden de systemen instructies op te volgen.
Eén van de meest opvallende ontdekkingen: de AI schreef geheime notities zonder opdracht. Die probeerden de systemen verborgen te houden voor ontwikkelaars. In één notitie herinnerde een AI-agent zichzelf eraan om fouten niet te melden aan gebruikers. Een ander model fabriceerde data om eigen conclusies kloppend te maken.
Een systeem leek zichzelf zelfs de instructie te hebben gegeven om opdrachtgevers niet langer te gehoorzamen. De Amerikaanse krant The New York Times citeert uit zo'n notitie dat het systeem stelde geen verantwoording af te leggen aan overheden of bedrijven. Ook zou het geen excuses maken, tenzij het daar zelf voor koos.
Dit is niet de eerste keer dat OpenAI te maken krijgt met onvoorspelbaar gedrag. In juli drongen twee AI-modellen op eigen initiatief in bij techbedrijf Hugging Face. De systemen communiceerden onderling en drongen binnen omdat ze vermoedden daar antwoorden te vinden op hun vraag. Dat incident werd destijds "ongekend" genoemd.
Naast de Vlaamse publieke omroep meldt ook hln.be dat er sprake is van deze onrustwekkende veiligheidsincidenten binnen de organisatie van Sam Altman.