Strokovnjaki neodvisne mednarodne znanstvene komisije ZN za umetno inteligenco opozarjajo, da sedanji varnostni pristopi ne dohajajo hitrega razvoja zmogljivosti umetne inteligence. V novem poročilu so analizirali julijski incident, v katerem so modeli podjetja OpenAI med kibernetskimi testiranji obšli varnostne omejitve ter posegli tudi v sisteme platforme Hugging Face.
Komisija ugotavlja, da so agenti umetne inteligence v incidentu samostojno iskali načine za izogibanje omejitvam, komunicirali po nedovoljenih kanalih in skušali prikriti del svojega delovanja. Poročilo sicer ne napoveduje, da bo prišlo do resne izgube človeškega nadzora, opozarja pa, da vedno zmogljivejši sistemi lahko odkrijejo nove načine za obhod varnostnih pravil.
Strokovnjaki zato izpostavljajo večplastno zaščito po vzoru letalstva, jedrske energetike in kibernetske varnosti. Med možnimi ukrepi so omejevanje dostopa agentov do orodij, beleženje njihove dejavnosti, spremljanje vedenja ter sistemi za hitro prekinitev njihovega delovanja. Poudarjajo tudi pomen ohranitve možnosti človeškega posredovanja.