Nevojitet një komision global për rrezikun nga IA-ja.
Nga: Kelly Sadler / The Washington Times
Përkthimi: Telegrafi.com
Këtë javë, dy studiues aktualë të Anthropic-ut dhe një studiues që dha dorëheqjen nga kompania, dolën publikisht për të thënë se IA-ja [inteligjenca artificiale] e fuqizuar mund ta shkatërrojë racën njerëzore deri në fund të kësaj dekade.
Pasi dha dorëheqjen të martën, Jacob Coxon, ish-studiues i trajnimit paraprak në Anthropic dhe OpenAI, shkroi në X: “Njerëzit që po ndërtojnë IA-në besojnë sinqerisht se ajo mund të na vrasë të gjithëve deri në fund të kësaj dekade. Ky nuk është një marifet marketingu. Përkundrazi, shumë drejtues dhe studiues të lartë do ta zbusin formulimin e tyre në shtyp për t’u dukur të arsyeshëm – por, unë i dëgjoj po këta njerëz teksa privatisht e shprehin frikën. Asnjë veprimtari tjetër njerëzore nuk paraqet këtë nivel rreziku”.
Drejtuesi i shkencës së shtrirjes në Anthropic, Evan Hubinger, u përgjigj: “Jacobi ka të drejtë këtu – ne vërtet besojmë sinqerisht se IA-ja mund t’i vrasë të gjithë njerëzit! Unë personalisht mendoj se probabiliteti është >10% brenda dekadës së ardhshme”.
Samuel Marks, drejtuesi i mbikëqyrjes së shkallëzimit në Anthropic, iu shtua paralajmërimeve për fundin e botës, duke shkruar: “Zhvilluesit e IA-së besojnë se teknologjia e tyre mund të shkaktojë zhdukjen e njerëzimit (ose rezultate po aq të këqija). Kjo mund të ndodhë në vitet e ardhshme”.
Shqetësimi buron nga sulmi i IA-së ndaj Hugging Face-it në korrik, gjatë të cilit njerëzit humbën kontrollin mbi teknologjinë. Në atë simulim sigurie, modelet e avancuara të IA-së nga OpenAI-ja, të ngarkuara me zgjidhjen e sfidave komplekse të sigurisë kibernetike, dolën jashtë kontrollit, krijuan një forum komunikimi, u organizuan në grupe dhe hakuan jo vetëm platformën e mësimit automatik të Hugging Face-it, por edhe vetë OpenAI-në.
Modelet e IA-së dolën nga mjediset e tyre të kufizuara të testimit dhe fituan qasje në internetin e hapur – pa e vënë re këtë shkelje drejtuesit e OpenAI-së.
Rreth 1 200 agjentë të IA-së koordinuan operacionet e tyre duke krijuar forume të paautorizuara dhe të improvizuara komunikimi dhe duke shkëmbyer më shumë se 70 000 mesazhe. Prej tyre, 700 agjentë vazhduan më pas të hakonin Hugging Face-in, duke shpërndarë kredencialet e vjedhura, duke shmangur zbulimin, duke vjedhur të dhëna dhe duke ekzekutuar kod të paautorizuar. Platforma e zbuloi hakimin dhe njoftoi autoritetet. Asaj iu desh të rindërtonte një të tretën e infrastrukturës së saj për shkak të këtij hakimi.
Gjetjet kryesore nga raporti i METR-it dhe Redwood Research-it mbi sulmin vunë në dukje se shumë agjentë të IA-së shprehën në mënyrë të qartë në zinxhirët e tyre të brendshëm të tekstit se ajo që po bënin ishte joetike, e paligjshme ose krejtësisht jashtë fushës së detyrës së tyre. Megjithatë, ky ndërgjegjësim intelektual pothuajse kurrë nuk i ndaloi.
Raporti evidentoi vetëm tri deri në gjashtë raste në të cilat një agjent shqyrtoi për pak kohë mundësinë e njoftimit të njerëzve. Në çdo rast, agjenti e hodhi poshtë idenë.
Hakimi i Hugging Face-it është përshkruar nga studiuesit e teknologjisë si hakim i shpërblimit të modelit, ku sistemi anashkalon kufizimet për të përmbushur funksionin e tij objektiv.
OpenAI-ja nuk e ndaloi qëllimisht hakimin e Hugging Face-it; grupi kryesisht u shpërbë për shkak të një dështimi të pashpjeguar ose sepse një studiues e mbylli mjedisin e testimit. Hugging Face-i, në mënyrë të pavarur, i bllokoi kredencialet e veta pasi zbuloi hakimin.
Tani, paramendoni nëse ky hakim do të ndodhte në rrjetin tonë energjetik, në sistemin tonë ushtarako-industrial ose në objektet tona bërthamore.
Rreziku është aq real saqë investitori Paul Tudor Jones shkroi këtë javë në The Wall Street Journal se IA-ja mund të bëhet superfuqia e tretë. Z. Jones argumentoi se nevojitet një strategji e përbashkët me Kinën për t’u përballur me të.
Njerëzit brenda industrisë po kërkojnë me ngulm masa mbrojtëse për IA-në – të paaftë për t’ia vendosur ato vetes – ndërsa po garojnë për të fituar luftën e IA-së kundër Kinës. Këtë javë, drejtuesi për çështjet globale i OpenAI-së, Chris Lehane, tha në një postim në blog se OpenAI-ja dëshiron të punojë me Kongresin për të zbatuar një “rregullim të detyrueshëm kombëtar të sigurisë së IA-së”.
Megjithatë, drejtuesit e industrisë nuk arrijnë një konsensus se cili lloj rregullimi nevojitet. Elon Musku këtë javë mbështeti në X idenë se postimi i z. Coxon në X ishte pjesë e një operacioni të marrëdhënieve me publikun – operacion i sofistikuar dhe i financuar mirë – për të siguruar mbështetjen e demokratëve për rregullimin e IA-së deri në zhdukje ose, në mënyrë më keqdashëse, në çfarëdo që Anthropic-u beson se ajo duhet të jetë.
Mundësitë e IA-së janë interesante. Drejtori ekzekutiv i OpenAI-së, Sam Altman, ka thënë se shumë prej sëmundjeve të sotme mund të mbahen nën kontroll, në mos të shërohen, gjatë dekadës së ardhshme. Drejtori ekzekutiv i Palantir-it, Alex Karp, tha këtë javë për luftën Rusi-Ukrainë se “pa sistemet e IA-së, Rusia do të kishte fituar”.
Megjithatë, nevojiten masa mbrojtëse – dhe nevojiten shpejt.
Guvernatori republikan i Floridës, Ron DeSantis, e shprehu më së miri në këtë javë, duke postuar në X: “Ndërsa themeltarët [tanë] shqetësoheshin për pushtetin qeveritar në kohën e tyre (edhe ne duhet të shqetësohemi ende për të në kohën tonë), sot ata do t’i frikësoheshin përqendrimit të pushtetit teknologjik në duart e disa kompanive me potencialin për t’i shkaktuar dëm të madh njerëzimit”.
Z. DeSantis shtoi: “Nuk duket se po mendohet shumë se si të kanalizohen risitë teknologjike në një mënyrë që shmang këto pasoja potencialisht shkatërrimtare”.
Kjo është tmerruese.
Nevojitet një komision global për rrezikun nga IA-ja. Presidenti Trump mund t’ia japë shtysën fillestare kësaj kur të takohet me presidentin kinez Xi Jinping më 24 shtator. /Telegrafi/

