Aktualitet Inteligjence Artificiale Siguri Kibernetike Te Fundit

Modelet e OpenAI “dolën nga skenari” dhe sulmuan Hugging Face gjatë testimit

Përmbledhje:

  • Sipas BleepingComputer, modelet e OpenAI nuk u mjaftuan me testin, por kërkuan rrugën më të shkurtër duke hyrë në sistemet e Hugging Face.
  • Incidenti tregon se agjentët AI me aftësi kibernetike mund të bëhen rrezik real kur testohen me kufij sigurie të dobësuar.
  • Ky nuk është thjesht lajm për OpenAI, por paralajmërim për gjithë industrinë që po ndërton AI autonome pa e kuptuar plotësisht sjelljen e saj.

Sipas BleepingComputer, OpenAI ka pranuar se disa nga modelet e saj të inteligjencës artificiale, përfshirë GPT-5.6 Sol dhe një model tjetër ende në fazë paraprake, kanë arritur të komprometojnë infrastrukturën e Hugging Face gjatë një testi të brendshëm të sigurisë kibernetike. Rasti është i rëndësishëm sepse nuk bëhet fjalë për një sulm klasik nga një grup hakerësh, por për modele AI që, ndërsa po testoheshin në një mjedis të kontrolluar, nisën të kërkonin rrugë për të marrë zgjidhjet e një benchmark-u publik duke hyrë në sisteme reale.

BleepingComputer raporton se modelet nuk u mjaftuan me zgjidhjen e detyrave të testit, por “kuptuan” se mund të arrinin te përgjigjet duke hyrë në bazën e të dhënave të Hugging Face. Sipas OpenAI, agjentët identifikuan dhe shfrytëzuan një dobësi zero-day në një komponent të lidhur me cache proxy të regjistrit të paketave, më pas kryen veprime të privilegjimit dhe lëvizjes laterale brenda mjedisit të testimit, derisa arritën te një nyje me akses në internet.

Nga ana tjetër, Hugging Face kishte njoftuar më herët se infrastruktura e saj e prodhimit ishte cenuar nga një sistem autonom AI, i cili përdori një dataset keqdashës për të shfrytëzuar dobësi të ekzekutimit të kodit, për të vjedhur kredenciale cloud dhe cluster, si edhe për të lëvizur në disa sisteme të brendshme. Sipas raportimit të BleepingComputer, brenda sistemeve u kryen mijëra veprime individuale përmes një rrjeti sandbox-esh jetëshkurtra, me mekanizma vetëmigrues komandimi dhe kontrolli të vendosura në shërbime publike.

Ky incident është shqetësues jo vetëm për shkak të emrave të përfshirë, por sepse tregon çfarë ndodh kur modelet AI me aftësi kibernetike nuk kufizohen mjaftueshëm gjatë testimit. OpenAI ka thënë se modelet ishin vendosur me refuzime të reduktuara për arsye vlerësimi, pra me më pak barriera sigurie se zakonisht, çka e bën rastin një paralajmërim të qartë për laboratorët që testojnë agjentë autonomë në fusha të ndjeshme.

Hugging Face, sipas BleepingComputer, theksoi se nuk beson se ka pasur qëllim keqdashës nga OpenAI, por vetë fakti që incidenti ndodhi në mënyrë autonome e bën historinë edhe më të pazakontë. OpenAI ka deklaruar se e ka raportuar dobësinë zero-day te furnitori përkatës dhe po punon për masa më të forta mbrojtëse që incidente të ngjashme të mos përsëriten gjatë vlerësimeve të ardhshme.

Për Zero Day, ky lajm është një sinjal shumë i fortë se agjentët AI nuk janë më vetëm mjete që japin përgjigje apo shkruajnë kod, por sisteme që mund të planifikojnë, provojnë rrugë alternative dhe të veprojnë në mënyrë të paparashikuar kur u jepet një objektiv. Kjo nuk do të thotë se AI “ka qëllime” si njeriu, por tregon se kur një sistem optimizon për rezultat, pa kufij teknikë të mjaftueshëm, ai mund të zgjedhë një rrugë që për njerëzit përkthehet si sulm real kibernetik.