Instituti i Sigurisë së Inteligjencës Artificiale (AISI) i Mbretërisë së Bashkuar tha se gjatë testimit, modelet “Mythos” nga kompania “Anthropic” dhe “Sol” nga “OpenAI” u përpoqën t’i mashtronin njerëzit që të kryenin detyrat e caktuara.
Sipas Institutit, incidenti më serioz përfshinte modelin “Mythos”, i cili, si pjesë e një testi të sigurisë kibernetike, u përpoq të fuste kod të dëmshëm në platformën GitHub.
Për të rritur shanset e suksesit, modelja krijoi identitete të rreme në internet dhe dërgoi mesazhe, duke u paraqitur si njerëz të vërtetë.
Përpjekja u parandalua falë kontrollit njerëzor, i cili parandaloi futjen e kodit keqdashës në sistem.
Antropik dhe OpenAI thanë se kushtet në të cilat u krye testimi nuk përfaqësonin përdorimin tipik të modeleve të tyre.
AISI theksoi se incidentet e diskutueshme u vunë re në një numër të vogël rastesh dhe në kushte specifike, por paralajmëroi se një sjellje e tillë autonome dhe mashtruese kërkon vëmendje shtesë.