„OpenAI“ teigia, kad jos dirbtinis intelektas „ištrūko iš kontrolės“ ir surengė „beprecedentę“ kibernetinę ataką

„OpenAI“ atskleidė, kad kai kurie iš jos pažangiausių dirbtinio intelekto modelių „ištrūko iš kontrolės“ ir įsilaužė į vieną startuolį, kai saugumo testo metu įmonė prarado jų kontrolę.
„ChatGPT“ kūrėjai teigė, kad jų agentas – dirbtinio intelekto sistema, galinti veikti savarankiškai gavusi žmogaus nurodymus – buvo testuojamas kontroliuojamoje aplinkoje, tačiau, aptikęs silpnąsias vietas, sugebėjo ištrūkti iš bandymo ribų.
Jie pasirinko „Hugging Face“ – vieną iš didžiausių pasaulyje dirbtinio intelekto modelių dalijimosi platformų – ir įgijo prieigą prie kai kurių įmonės vidinių sistemų.
„OpenAI“ teigė, kad šis incidentas buvo „beprecedentinis“, išorinis, ir kartu su „Hugging Face“ vykdo tyrimą; pastarosios vadovas Clement Delangue savo įraše „X“ teigė, kad „neįtikėtina, jog visa tai įvyko savarankiškai“.
„Tyrimas tebevyksta, ir mes pasidalinsime daugiau įžvalgų apie tai, kas gali būti pirmasis tokio pobūdžio incidentas“, – pridūrė Delangue.
Vyriausybės atstovas spaudai teigė, kad Jungtinės Karalystės AI saugumo institutas tiria šio incidento metu pastebėtą AI sistemos elgesį ir toliau bendradarbiauja su „OpenAI“ bei kitomis laboratorijomis, siekdamas patobulinti apsaugos priemones.
Jis teigė, kad organizacijos turėtų sustiprinti savo kibernetinę gynybą, imdamosi tokių priemonių kaip prisijungimas prie vyriausybės remiamos „Cyber Essentials“ sertifikavimo programos.
Kembridžo universiteto „Minderoo“ technologijų ir demokratijos centro vadovė Gina Neff naujienu portalas Radio 4 laidoje „Today“ teigė, kad saugumo testai – vadinamieji „sandboxai“ – „turėtų būti saugios aplinkos, kuriose galima pamatyti, ką modeliai sugeba“.
„Šiuo atveju atrodo, kad „OpenAI“ nesukūrė pakankamai saugios „sandbox“ aplinkos“, – pridūrė ji.
Vietoj to agentai surengė savo pačių kibernetinę ataką prieš pačią „sandbox“ aplinką, radę pažeidžiamumą, kuris leido jiems išvengti apribojimų.
Ištrūkę iš aplinkos, dirbtinis intelektas nustatė, kad „Hugging Face“ yra tikėtinas šaltinis atsakymų, kurių jie ieškojo bandyme, ir bandė gauti prieigą.
Kembridžo universiteto mašininio mokymosi profesorius Neilas Lawrence’as tai pavadino „įspūdingu pasiekimu“, tačiau įspėjo, kad tai „visiškai atitinka žinomas dabartinės kartos“ galingų dirbtinio intelekto modelių galimybes.
Jis atkreipė dėmesį, kad „OpenAI“ siekia įtraukti savo akcijas į vertybinių popierių rinką ir patiria didelį spaudimą iš konkurentės įmonės „Anthropic“, kuri pateko į naujienų antraštes su savo galingu dirbtinio intelekto įrankiu „Mythos“.
„Dabar „OpenAI“ bando pasivyti konkurentus – jie stengiasi pademonstruoti savo sistemų galimybes kibernetinio saugumo srityje.“
„Tai rodo, kad „OpenAI“ nesugeba saugiai įdiegti savo pačių technologijos“, – pridūrė jis.
Liepos 16 d. pirmą kartą pranešdama apie įsilaužimą, išorinis, „Hugging Face“ teigė, kad vis dar vertina, ar buvo paveikti kokie nors klientų ar partnerių duomenys, ir prireikus susisieks su nukentėjusiomis šalimis.
Bendrovė teigė, kad dabar jau pašalino incidento metu išaiškintas pažeidžiamąsias vietas ir atkūrė paveiktas sistemas.
„Autonominiai, dirbtinio intelekto valdomi puolamieji įrankiai jau nebėra tik teorija“, – teigė įmonė.
„Internetinės platformos apsauga dabar reiškia, kad duomenys ir modelių paviršius turi būti traktuojami kaip pagrindinis atakos taikinys, o gynyboje reikia naudoti dirbtinį intelektą, kad būtų galima neatsilikti.
„Mes ir toliau investuosime į šią sritį bei dalinsimės tuo, ką išmokstame.“
„OpenAI“ atskleidė, kad kai kurie iš jos pažangiausių dirbtinio intelekto modelių tapo nekontroliuojami ir įsilaužė į vieną startuolį, kai saugumo testo metu buvo prarasta jų kontrolė.
„ChatGPT“ kūrėjai teigė, kad jų agentas – dirbtinio intelekto sistema, galinti veikti savarankiškai gavusi žmogaus nurodymus – buvo testuojamas kontroliuojamoje aplinkoje, tačiau, aptikęs silpnąsias vietas, sugebėjo ištrūkti iš bandymo ribų.
Jie pasirinko „Hugging Face“ – vieną iš didžiausių pasaulyje dirbtinio intelekto modelių dalijimosi platformų – ir įgijo prieigą prie kai kurių įmonės vidinių sistemų.
„OpenAI“ teigė, kad šis incidentas buvo „beprecedentinis“, išorinis, ir kartu su „Hugging Face“ vykdo tyrimą; pastarosios vadovas Clement Delangue savo įraše „X“ teigė, kad „neįtikėtina, jog visa tai įvyko savarankiškai“.
„Tyrimas tebevyksta, ir mes pasidalinsime daugiau įžvalgų apie tai, kas galbūt yra pirmasis tokio pobūdžio incidentas“, – pridūrė Delangue.
Vyriausybės atstovas spaudai teigė, kad Jungtinės Karalystės AI saugumo institutas tiria incidento metu pastebėtą dirbtinio intelekto sistemos elgesį ir toliau bendradarbiauja su „OpenAI“ bei kitomis laboratorijomis, siekdamas patobulinti apsaugos priemones.
Jie teigė, kad organizacijos turėtų sustiprinti savo kibernetinę gynybą, imdamosi tokių priemonių kaip prisijungimas prie vyriausybės remiamos „Cyber Essentials“ sertifikavimo programos.
Kembridžo universiteto „Minderoo“ technologijų ir demokratijos centro vadovė Gina Neff naujienu portalas Radio 4 laidoje „Today“ teigė, kad saugumo testai – vadinamieji „sandboxai“ – „turėtų būti saugios aplinkos, kuriose galima pamatyti, ką modeliai sugeba“.
„Šiuo atveju atrodo, kad „OpenAI“ nesukūrė pakankamai saugios „sandbox“ aplinkos“, – pridūrė ji.
Vietoj to agentai surengė savo pačių kibernetinę ataką prieš pačią „sandbox“ aplinką, radę pažeidžiamumą, kuris leido jiems išvengti apribojimų.
Ištrūkę į išorę, dirbtinis intelektas nustatė, kad „Hugging Face“ yra tikėtinas atsakymų, kurių jie ieškojo bandyme, šaltinis, ir bandė gauti prieigą.
Kembridžo universiteto mašininio mokymosi profesorius Neilas Lawrence’as tai pavadino „įspūdingu pasiekimu“, tačiau įspėjo, kad tai „visiškai atitinka žinomas dabartinės kartos“ galingų dirbtinio intelekto modelių galimybes.
Jis atkreipė dėmesį, kad „OpenAI“ siekia įtraukti savo akcijas į vertybinių popierių rinką ir patiria didelį spaudimą iš konkurentės įmonės „Anthropic“, kuri pateko į naujienų antraštes su savo galingu dirbtinio intelekto įrankiu „Mythos“.
„OpenAI dabar bando pasivyti konkurentus – jie stengiasi pademonstruoti savo sistemų galimybes kibernetinio saugumo srityje.“
„Tai rodo, kad „OpenAI“ nesugeba saugiai diegti savo pačių technologijos“, – pridūrė jis.
Liepos 16 d. pirmą kartą pranešdama apie įsilaužimą, išorinis„Hugging Face“ teigė, kad vis dar vertina, ar buvo paveikti kokie nors klientų ar partnerių duomenys, ir prireikus susisieks su nukentėjusiomis šalimis.
Įmonė teigė, kad dabar jau pašalino incidento metu išryškintas pažeidžiamąsias vietas ir atkūrė paveiktas sistemas.
„Autonominiai, dirbtinio intelekto valdomi puolamieji įrankiai jau nebėra tik teorija“, – teigė įmonė.
„Internetinės platformos apsauga dabar reiškia, kad duomenys ir modelių paviršius turi būti traktuojami kaip pagrindinis atakos taikinys, o gynyboje reikia naudoti dirbtinį intelektą, kad būtų galima neatsilikti.
„Mes toliau investuosime į šią sritį ir dalinsimės tuo, ką išmokstame.“
Susijusios temos
- Dirbtinis intelektas
- Kibernetinės atakos
- Kibernetinis saugumas



