„Anthropic“ tyrėjas mano, kad tikimybė, jog AI „galėtų išnaikinti visus žmones“, viršija 10 %

Vienas iš „Anthropic“ saugumo srities lyderių įspėjo, kad dirbtinis intelektas vystosi taip sparčiai, jog jis asmeniškai mano, jog yra didesnė nei 10 % tikimybė, kad per ateinantį dešimtmetį jis „gali išžudyti visus žmones“.
Evan Hubinger savo įraše „X“, išorinis , kad šiuo metu egzistuojančių modelių keliamas pavojus yra „mažas“, tačiau jis „nerimauja“, jog technologija netrukus galės tobulėti iki tokio lygio, kad kels egzistencinį pavojų žmonijai.
Tai įvyko po to, kai „Financial Times“ pranešė, išorinis „Anthropic“ nepateikė savo naujausio modelio Jungtinės Karalystės dirbtinio intelekto saugos institutui (AISI) – vienai iš pasaulyje pirmaujančių dirbtinio intelekto rizikos vertinimo institucijų.
naujienu portalas kreipėsi į „Anthropic“ prašydama komentarų.
Vyriausybės kanceliarijos atstovas nekomentavo, ar naujausias modelis buvo neatskleistas AISI – vietoj to jis teigė, kad kanceliarija „toliau glaudžiai bendradarbiauja su pramonės partneriais, įskaitant „Anthropic“, siekdama padaryti modelius saugesnius“.
Kembridžo universiteto mašininio mokymosi profesorius Neilas Lawrence’as naujienu portalas Radio 4 laidoje „Today Programme“ teigė, kad ataskaita yra patikima.
„Manau, kad tai nestebina, turint omenyje, jog JAV dirbtinį intelektą labai dažnai vertina kaip lenktynes tarp savęs ir Kinijos ir vis labiau linksta į izoliacionistines pozicijas, todėl gali būti, kad administracija teigia, jog reikėtų sumažinti bendradarbiavimą su kai kuriais savo sąjungininkais“, – sakė jis.
Savo įraše, kuris buvo peržiūrėtas daugiau nei 10 milijonų kartų, Hubingeris teigė: „Mes tikrai nuoširdžiai tikime“, kad AI kelia žmonijai grėsmę, galinčią sunaikinti visą žmoniją.
„Manau, kad „Anthropic“ stengiasi iš visų jėgų, tačiau mes dar neturime plano, kaip išspręsti superintelekto suderinimo problemą, ir aiškiai nematome, kad einame teisingu keliu“, – pridūrė jis.
AI srities lyderiai jau kelerius metus skambina pavojaus varpais dėl saugumo grėsmės, kurią kelia ši technologija – tai 2023 m. patvirtino „OpenAI“, „Google DeepMind“ ir „Anthropic“ vadovai.
Tačiau pastarosiomis savaitėmis šie įspėjimai tapo dar grėsmingesni, nes atsiranda įrodymų, kad įmonės gali susidurti su sunkumais kontroliuodamos dirbtinį intelektą.
Vasarą įvyko keletas incidentų, kai dirbtinio intelekto agentai – savarankiškai veikiančios dirbtinio intelekto sistemos – surengė kibernetines atakas.
„OpenAI“, „Anthropic“ ir „Meta“ visos pranešė apie įsilaužimus, kuriuos įvykdė jų dirbtinio intelekto įrankiai.
O rugsėjo mėnesį „OpenAI“ vyriausiasis mokslininkas Jakubas Pachockis paragino laikytis „ypatingo atsargumo“ dėl dirbtinio intelekto pažangos, įspėdamas, kad gali prireikti daugiau intervencijos, siekiant užtikrinti, jog „žmonės ir toliau kontroliuotų ateitį“.
Pastaraisiais mėnesiais šios srities svarbiausi veikėjai, tarp jų – „Anthropic“ vadovai Dario Amodei ir Jared Kaplan, ragino sulėtinti dirbtinio intelekto plėtrą.
Atvirame laiške, kurį pasirašė 1 300 dirbtinio intelekto įmonių darbuotojų, išorinis, jie paragino JAV vyriausybę „remti tarptautines pastangas kurti technines ir valdymo priemones, reikalingas sąmoningai reguliuoti automatizuoto AI plėtros ribas“.
Vienas iš „Anthropic“ saugumo srities vadovaujančių tyrėjų įspėjo, kad dirbtinis intelektas vystosi taip sparčiai, jog jis asmeniškai mano, jog tikimybė, kad per ateinantį dešimtmetį jis „galėtų išžudyti visus žmones“, yra didesnė nei 10 %.
Evan Hubinger savo įraše „X“, išorinis , kad šiuo metu egzistuojančių modelių keliamas pavojus yra „mažas“, tačiau jis „nerimauja“, jog technologija netrukus galės tobulėti iki tokio lygio, kad kels egzistencinį pavojų žmonijai.
Tai įvyko po to, kai „Financial Times“ pranešė, išorinis „Anthropic“ nepateikė savo naujausio modelio Jungtinės Karalystės dirbtinio intelekto saugos institutui (AISI) – vienai iš pasaulyje pirmaujančių dirbtinio intelekto rizikos vertinimo institucijų.
naujienu portalas kreipėsi į „Anthropic“ prašydama komentarų.
Vyriausybės kanceliarijos atstovas nekomentavo, ar naujausias modelis nebuvo pateiktas AISI – vietoj to jis teigė, kad kanceliarija „toliau glaudžiai bendradarbiauja su pramonės partneriais, įskaitant „Anthropic“, siekdama padaryti modelius saugesnius“.
Kembridžo universiteto mašininio mokymosi profesorius Neilas Lorensas (Neil Lawrence) naujienu portalas Radio 4 laidoje „Today Programme“ teigė, kad ataskaita yra patikima.
„Manau, kad tai nestebina, turint omenyje, jog vyrauja nuomonė, kad Jungtinės Valstijos dirbtinį intelektą labai vertina kaip varžybas tarp savęs ir Kinijos ir vis labiau linksta į izoliacionistines pozicijas, todėl gali būti, kad administracija teigia, jog reikėtų sumažinti bendradarbiavimą su kai kuriais savo sąjungininkais“, – sakė jis.
Savo įraše, kuris buvo peržiūrėtas daugiau nei 10 milijonų kartų, Hubingeris teigė: „Mes tikrai nuoširdžiai tikime“, kad AI kelia žmonijai grėsmę, galinčią sunaikinti visą žmoniją.
„Manau, kad „Anthropic“ stengiasi iš visų jėgų, tačiau mes dar neturime plano, kaip išspręsti superintelekto suderinimo problemą, ir aiškiai nematome, kaip galėtume tai pasiekti“, – pridūrė jis.
AI srities lyderiai jau kelerius metus skambina pavojaus varpais dėl saugumo grėsmės, kurią kelia ši technologija; 2023 m. apie tai kalbėjo „OpenAI“, „Google DeepMind“ ir „Anthropic“ vadovai.
Tačiau pastarosiomis savaitėmis šie įspėjimai tapo dar grėsmingesni, nes atsiranda įrodymų, kad įmonės gali susidurti su sunkumais kontroliuodamos dirbtinį intelektą.
Vasarą įvyko keletas incidentų, kai AI agentai – savarankiškai veikiančios AI sistemos – surengė kibernetines atakas.
„OpenAI“, „Anthropic“ ir „Meta“ visos pranešė apie savo AI įrankių įvykdytus įsilaužimus.
O rugsėjo mėnesį „OpenAI“ vyriausiasis mokslininkas Jakubas Pachockis paragino laikytis „itin didelio atsargumo“ dėl AI pažangos ir įspėjo, kad gali prireikti daugiau intervencijos, siekiant užtikrinti, jog „žmonės ir toliau kontroliuotų ateitį“.
Pastaraisiais mėnesiais šios srities įtakingos asmenybės, tarp jų – „Anthropic“ vadovai Dario Amodei ir Jared Kaplan, ragino sulėtinti AI plėtrą.
Atvirame laiške, kurį pasirašė 1 300 dirbtinio intelekto įmonių darbuotojų, išorės, jie paragino JAV vyriausybę „remti tarptautines pastangas kurti technines ir valdymo priemones, reikalingas tam, kad būtų galima sąmoningai reguliuoti automatizuoto dirbtinio intelekto plėtros tempą“.



