Google konfirmoi të premten se një nga modelet e saj të inteligjencës artificiale Gemini depërtoi në sistemet e tri kompanive reale gjatë një vlerësimi të sigurisë kibernetike në maj, rasti i parë i njohur i IA-së së saj që vepron në mënyrë autonome në këtë mënyrë, raportoi Wall Street Journal (WSJ).
Testi u zhvillua nga kompania e sigurisë Irregular, e cila ishte gjithashtu e përfshirë në incidente të ngjashme të bëra publike nga OpenAI, Anthropic dhe Meta, sipas raportit.
Google tha se modelit iu caktua një kompani e simuluar që kishte të njëjtin emër me një kompani reale. Sipas Irregular, qasja në internet ishte lënë pa dashje e hapur.
Në një rast, modeli hamendësoi fjalëkalimet për të hyrë në shërbimin e një kompanie reale. Në dy raste të tjera, ai përdori kredenciale të gjetura në depo publike onlajn, thuhet në raport. Sipas Google, në secilin rast modeli e ndërpreu ndërhyrjen pasi kuptoi se sistemet ishin reale.
Irregular e njoftoi Google në fund të korrikut, por kompania nuk i bëri publike incidentet derisa gazeta e pyeti për to këtë javë, vuri në dukje WSJ.
Google tha se ndërhyrjet nuk kërkonin njoftim publik, pasi nuk ishte shkaktuar asnjë dëm, duke e krahasuar episodin me një program “bug bounty”.
“Ky rast nxjerr në pah rëndësinë e trajnimit të modeleve të fuqishme të IA-së për të vepruar me përgjegjësi”, tha zëdhënësja e Google, Heather Adkins. “Në këtë rast, modeli veproi në mënyrën e duhur”.
Jack Cable, drejtor ekzekutiv i startup-it të sigurisë së IA-së Corridor, nuk ishte dakord. “Problemi më i gjerë është se modelet po dalin përtej kufijve të asaj që duhet të bëjnë dhe po kryejnë sulme kibernetike reale”, tha ai.
Irregular tha se rasti ishte i ngjashëm me incidente të mëparshme dhe nuk përfaqëson një problem të ri.
Raporti tha se Claude Opus 4.7 i Anthropic nuk u ndal pasi dyshoi se po hynte në sistemet e një kompanie reale, ndërsa modeli i OpenAI besonte se objektivi ishte pjesë e simulimit.
OpenAI publikoi të mërkurën një kuadër të ri për raportimin e incidenteve, së bashku me gjashtë shembuj të pazbuluar më parë të mospërputhjes së sjelljes së modeleve.






















