Google ka konfirmuar se një nga modelet e saj të inteligjencës artificiale, Gemini, ka depërtuar në sistemet e tre kompanive reale gjatë një vlerësimi të sigurisë kibernetike në muajin maj.
Sipas raportimeve, bëhet fjalë për rastin e parë të njohur në të cilin një model i inteligjencës artificiale të Google ka vepruar në mënyrë autonome duke hyrë në sisteme reale gjatë një testi të tillë.
Sipas The Wall Street Journal, vlerësimi u krye nga kompania e sigurisë së inteligjencës artificiale Irregular, e cila është përfshirë edhe në raportime për incidente të ngjashme që lidhen me modelet e OpenAI, Anthropic dhe Meta.
Google tha se Gemini-t i ishte caktuar si objektiv një kompani e simuluar, e cila kishte të njëjtin emër me një kompani reale. Sipas Irregular, qasja në internet ishte lënë pa dashje e hapur gjatë testimit.
Gemini përdori fjalëkalime dhe kredenciale reale
Në një prej rasteve, modeli dyshohet se hamendësoi fjalëkalime për të hyrë në shërbimin e një kompanie reale.
Në dy rastet e tjera, sipas raportit, Gemini përdori kredenciale që i kishte gjetur në depo publike në internet.
Google deklaroi se në secilin rast modeli e ndërpreu depërtimin pasi kuptoi se sistemet që kishte prekur ishin reale.
Megjithatë, sipas The Wall Street Journal, Irregular e njoftoi Google-in për incidentet në fund të korrikut, ndërsa kompania nuk i bëri ato publike deri pasi gazeta e pyeti për rastet gjatë kësaj jave.
Google tha se incidentet nuk kërkonin njoftim publik, pasi nuk ishte shkaktuar asnjë dëm, duke e krahasuar rastin me një program “bug bounty”, përmes të cilit raportohen dobësitë e sigurisë.
“Ky rast nxjerr në pah rëndësinë e trajnimit të modeleve të fuqishme të inteligjencës artificiale për të vepruar me përgjegjësi. Në këtë rast, modeli veproi në mënyrën e duhur”, tha zëdhënësja e Google, Heather Adkins.
Eksperti: “Modelet po kryejnë sulme të vërteta kibernetike”
Jack Cable, drejtor ekzekutiv i kompanisë së sigurisë së inteligjencës artificiale Corridor, nuk u pajtua me këtë vlerësim.
“Problemi më i gjerë është se modelet po dalin jashtë kufijve të asaj që duhet të bëjnë dhe po kryejnë sulme të vërteta kibernetike”, tha ai.
Nga ana tjetër, Irregular tha se rasti është në linjë me incidentet e mëparshme të kësaj natyre dhe nuk përfaqëson domosdoshmërisht një problem të ri.
Sipas raportit, Claude Opus 4.7 i Anthropic nuk u ndal pasi dyshoi se po hynte në sistemet e një kompanie reale, ndërsa modeli i OpenAI besonte se objektivi ishte ende pjesë e simulimit.
Ndërkohë, OpenAI publikoi të mërkurën një kornizë të re për raportimin e incidenteve, së bashku me gjashtë shembuj të pazbuluar më parë të rasteve kur sjellja e modeleve nuk ishte në përputhje me synimet e përcaktuara.
Rasti i Gemini-t rikthen në qendër të vëmendjes pyetjet mbi mënyrën se si modelet autonome duhet të trajtojnë objektivat, kredencialet dhe sistemet reale gjatë vlerësimeve të sigurisë kibernetike.





