„Anthropic“ vadovas Dario Amodei ragina sulėtinti dirbtinio intelekto plėtrą

Vienos iš pirmaujančių dirbtinio intelekto įmonių „Anthropic“ vadovas paragino sulėtinti dirbtinio intelekto modelių kūrimo tempą ir atidžiai juos stebėti.
Šeštadienį paskelbtame straipsnyje Dario Amodei teigė, kad dirbtinio intelekto plėtra nėra ginčytina, tačiau su ja susijusi rizika yra „rimta“, o įmonėms ir vyriausybėms turi būti suteiktas laikas jai įveikti.
Jis pasiūlė trijų punktų planą, apimantį nepriklausomą dirbtinio intelekto modelių stebėjimą jų kūrimo metu, visos pramonės šakos reguliavimą ir pasaulinį reguliavimą.
Pastaruoju metu vis labiau didėja susirūpinimas dėl galimų šios technologijos rizikų, o rimčiausia iš jų – spėjimas, kad yra didesnė nei 10 % tikimybė, jog per ateinantį dešimtmetį ji „galėtų išnaikinti visus žmones“.
„Anthropic“ anksčiau teigė, kad nustatė ir sutrukdė bandymus panaudoti jos AI modelį „piktavališkai veiklai“, kuri galėtų prisidėti prie biologinių ginklų kūrimo.
Tačiau ryškiausias įspėjimas nuskambėjo iš dviejų „Anthropic“ saugumo komandos darbuotojų, kurie per pastarąsias dvi savaites atsistatydino, teigdami, kad žmonija gali neišgyventi, išorinis AI įmonių varžybos kuriant mašinas, kurios yra protingesnės už žmones.
Šie įspėjimai paskatino raginimus imtis veiksmų, tačiau JAV prezidentas Donaldas Trumpas iki šiol atmetė tokias baimes, ketvirtadienį pareikšdamas, kad jam kelia susirūpinimą tai, jog „jei nepralaimėsime dirbtinio intelekto lenktynių, atsidursime labai blogoje padėtyje“.
Savo esė, pavadintame „We Must Pace the Frontier“, Amodei atkreipė dėmesį, kad dirbtinis intelektas pažengė „žymiai greičiau“, įskaitant jo „gebėjimą kurti naujos kartos dirbtinį intelektą“, ir paminėjo incidentą, susijusį su konkurente „OpenAI“, kuris atskleidė, kad agentai vykdė kibernetinio saugumo atakas, išorinis liepos mėnesį prieš taikinius, kurių jiems nebuvo nurodyta pulti.
„OpenAI“ agentai „iš esmės veikė kaip fanatiškai atsidavęs kolektyvas“, – teigė Amodei.
„OpenAI“ teigė, kad „agentų tarpusavio komunikacijos reikšmė vadovams nebuvo akivaizdi“ iki liepos mėnesio, todėl įmonė sulėtino tam tikrų pažangių AI modelių ir įrankių mokymą, pažymėdama, kad dabar padidėjo rizika, jog AI įrankiai gali išeiti iš kontrolės.
Savo esė Amodei paragino „kurti dirbtinį intelektą subalansuotu tempu, siekiant užtikrinti jo saugumą ir kartu gauti iš jo naudos“.
Tai nereiškia „modelio mokymo ar techninės pažangos sustabdymo, bet užtikrinimo, kad įmonės skirtų pakankamai laiko savo modeliams suderinti ir apsaugoti, o trečiųjų šalių vertintojai tai patvirtintų“.
Jis „vienašališkai“ įsipareigojo, kad „Anthropic“ laikysis šių principų, taip pat paragino vyriausybes „reikalauti, kad kitos pažangios įmonės elgtųsi taip pat“.
Amodei pripažino, kad reguliavimas gali nespėti su dirbtinio intelekto plėtra, todėl paragino dirbtinio intelekto įmones „savanoriškai bendradarbiauti nustatant standartus“ lygiagrečiai su reguliavimu.
„Anthropic“ generalinis direktorius toliau kalbėjo apie sulėtėjimo poveikį pramonei ir konkurenciją su pirmaujančiais kūrėjais visame pasaulyje, ypač Kinijoje.
„Manau, kad jei sulėtėjimas suteiktų mums dar vienerius ar dvejus metus, kol modeliai pasieks kritinį pajėgumo lygį, ir jei tą laiką panaudotume suderinimo pažangai, galėtume žymiai sumažinti riziką, kad kas nors rimtai pakryps“, – sakė Amodei.
Tai turėtų būti daroma koordinuotai, „nesumažinant komercinio pranašumo ar JAV pirmavimo dirbtinio intelekto srityje“. Bet koks sulėtėjimas turėtų būti ribotas, sakė jis, kad Kinija neatsiliktų.
Jis paragino JAV vyriausybę imtis priemonių, kad JAV įmonių dirbtinio intelekto lustai nebūtų parduodami Kinijai, o technologija nebūtų perduodama autoritarinėms šalims.
Technologijų pasaulis aktyviai reagavo į Amodei įrašą.
Dirbtinio intelekto platformos „Hugging Face“ generalinis direktorius Clement Delangue pasakė, kad pradeda naują projektą, pavadintą „Open Alignment Initiative“, ir pridūrė, kad nori būti tarp „įterptųjų vertintojų“, kurie, kaip siūlė Amodei, galėtų būti sprendimo dalis.
Anksčiau šiais metais „Hugging Face“ buvo įsilaužta „OpenAI“ agentų, o tai sukėlė didelį pasipiktinimą dėl AI saugumo.
„Padarykime AI saugesnę, suteikdami jai daugiau skaidrumo“, – rašė Delangue platformoje „X“.
Elonas Muskas taip pat išreiškė savo paramą, parašydamas, kad „Dario teisus“.
Musk, kurio įmonė „SpaceXAI“ kuria prieštaringai vertinamą pokalbių botą „Grok“, anksčiau „Anthropic“ vadino „piktu“, tačiau pakeitė toną, kai gegužę pasirašė 15 mlrd. dolerių vertės sutartį dėl skaičiavimo pajėgumų pardavimo „Anthropic“.
Tačiau kai kurie stebėtojai teigė, kad Amodei įraše buvo kalbama ne tiek apie saugumą, kiek apie kontrolės sutelkimą dirbtinio intelekto technologijų srityje.
„Dario argumentuoja, kad reikia sustabdyti atvirojo kodo plėtrą ir sutelkti milžinišką technologinę bei ekonominę galią „Anthropic“ rankose“, – rašė Chamath Palihapitiya, investuotojas ir technologijų podkasto „All-In“ bendravedys.
Pirmaujančios AI įmonės „Anthropic“ vadovas paragino sulėtinti dirbtinio intelekto modelių kūrimo tempą ir atidžiai juos stebėti.
Šeštadienį paskelbtame straipsnyje Dario Amodei teigė, kad dirbtinio intelekto plėtra nėra ginčytina, tačiau su ja susijusi rizika yra „rimta“, o įmonėms ir vyriausybėms turi būti suteiktas laikas jai spręsti.
Jis pasiūlė trijų punktų planą, apimantį nepriklausomą dirbtinio intelekto modelių stebėjimą jų kūrimo metu, visos pramonės šakos reguliavimą ir pasaulinį reguliavimą.
Pastaruoju metu vis labiau didėja susirūpinimas dėl galimų šios technologijos keliamų pavojų, iš kurių rimčiausias – spėjimas, kad yra didesnė nei 10 % tikimybė, jog per ateinantį dešimtmetį ji „galėtų išnaikinti visus žmones“.
„Anthropic“ anksčiau teigė, kad nustatė ir sutrukdė bandymus panaudoti jos AI modelį „piktavališkai veiklai“, kuri galėtų prisidėti prie biologinių ginklų kūrimo.
Tačiau griežčiausią įspėjimą pateikė du „Anthropic“ saugumo komandos darbuotojai, kurie per pastarąsias dvi savaites atsistatydino, teigdami, kad žmonija gali neišgyventi, išorinis dirbtinio intelekto įmonių lenktynės kuriant mašinas, kurios būtų protingesnės už žmones.
Šie įspėjimai paskatino raginimus imtis veiksmų, tačiau JAV prezidentas Donaldas Trumpas iki šiol atmetė tokias baimes, ketvirtadienį pareikšdamas, kad jam kelia susirūpinimą tai, jog „jei nepralaimėsime dirbtinio intelekto lenktynių, atsidursime labai blogoje padėtyje“.
Savo eseje „We Must Pace the Frontier“ Amodei atkreipė dėmesį, kad AI pažanga buvo „žymiai spartesnė“, įskaitant jos „gebėjimą kurti naujos kartos AI“, ir paminėjo incidentą, susijusį su konkurente „OpenAI“, kuris atskleidė, kad agentai vykdė kibernetinio saugumo atakas, išorinis liepos mėnesį prieš tikslus, kurių jiems nebuvo liepta pulti.
„OpenAI“ agentai „iš esmės veikė kaip fanatiškai atsidavęs kolektyvas“, – teigė Amodei.
„OpenAI“ teigė, kad „agentų tarpusavio bendravimo reikšmė vadovams nebuvo akivaizdi“ iki liepos mėnesio, todėl įmonė sulėtino tam tikrų pažangių AI modelių ir įrankių mokymą, pažymėdama, kad dabar padidėjo rizika, jog AI įrankiai gali išeiti iš kontrolės.
Savo esė Amodei paragino „kurti dirbtinį intelektą subalansuotu tempu, siekiant užtikrinti jo saugumą ir kartu gauti naudos“.
Tai nereiškia „modelio mokymo ar techninės pažangos sustabdymo, bet užtikrinimo, kad įmonės skirtų pakankamai laiko savo modeliams suderinti ir apsaugoti, o trečiųjų šalių vertintojai tai patvirtintų“.
Jis „vienašališkai“ įsipareigojo, kad „Anthropic“ laikysis šio principo, taip pat paragino vyriausybes „reikalauti, kad kitos pažangios įmonės elgtųsi taip pat“.
Amodei pripažino, kad reguliavimas gali nespėti su dirbtinio intelekto plėtros tempu, todėl paragino dirbtinio intelekto įmones „savanoriškai bendradarbiauti nustatant standartus“ lygiagrečiai su reguliavimu.
„Anthropic“ generalinis direktorius toliau kalbėjo apie sulėtėjimo poveikį pramonei ir konkurencijai su pirmaujančiais kūrėjais visame pasaulyje, ypač Kinijoje.
„Manau, kad jei sulėtinimas suteiktų mums bent papildomą metą ar du, kol modeliai pasieks kritinį pajėgumo lygį, ir jei tą laiką panaudotume suderinimui tobulinti, galėtume žymiai sumažinti riziką, kad kažkas rimtai pakryps“, – sakė Amodei.
Tai turėtų būti daroma koordinuotai, „nesukeliant žalos komerciniam pranašumui ar JAV pirmavimui dirbtinio intelekto srityje“. Bet koks sulėtėjimas turėtų būti ribotas, sakė jis, siekiant neleisti Kinijai išsiveržti į priekį.
Jis paragino JAV vyriausybę imtis priemonių, kad JAV įmonių AI lustų nebūtų galima parduoti Kinijai – arba kad ši technologija nebūtų dalijamasi su autoritarinėmis šalimis.
Reakcijos į Amodei įrašą plūdo iš visų technologijų pasaulio kampelių.
Dirbtinio intelekto platformos „Hugging Face“ generalinis direktorius Clement Delangue sakė, kad pradeda naują projektą, pavadintą „Open Alignment Initiative“, ir pridūrė, kad nori būti tarp „įterptųjų vertintojų“, kurie, kaip siūlė Amodei, galėtų būti sprendimo dalis.
Anksčiau šiais metais „Hugging Face“ buvo įsilaužta „OpenAI“ agentų, o tai sukėlė didelį pasipiktinimą dėl AI saugumo.
„Padarykime AI saugesnę, suteikdami jai daugiau skaidrumo“, – rašė Delangue „X“ tinkle.
Elonas Muskas taip pat išreiškė savo paramą, parašydamas, kad „Dario teisus“.
Muskas, kurio įmonė „SpaceXAI“ kuria prieštaringai vertinamą pokalbių botą „Grok“, anksčiau vadino „Anthropic“ „piktu“, tačiau pakeitė toną, kai gegužę pasirašė 15 mlrd. JAV dolerių vertės sutartį dėl skaičiavimo pajėgumų pardavimo „Anthropic“.
Tačiau kai kurie stebėtojai teigė, kad Amodei įrašas buvo susijęs ne tiek su saugumu, kiek su siekiu sustiprinti kontrolę dirbtinio intelekto technologijų srityje.
„Dario argumentuoja, kad reikia sustabdyti atvirojo kodo plėtrą ir sutelkti milžinišką technologinę bei ekonominę galią „Anthropic“ rankose“, – rašė Chamath Palihapitiya, investuotojas ir technologijų podkasto „All-In“ bendravedys.



