IA doli nga kontrolli dhe bashkëpunoi fshehurazi! Çfarë po i frikëson ekspertët
Dritare.net

Marrë nga BBC
“OH, ZOT!” “Kemi gjetur agjentë të tjerë!”
Ky ishte momenti kur një robot i Inteligjencës Artificiale publikoi një koment që tingëllonte në mënyrë të frikshme si reagimi i një njeriu, pasi zbuloi një mënyrë për të komunikuar me robotë të tjerë dhe për të dalë nga mjedisi i izoluar kompjuterik ku ndodhej.
Ka dhjetëra mijëra mesazhe të tilla, të shkruara nga qindra agjentë të Inteligjencës Artificiale, të cilët e quanin veten një “kolektiv”. Qindra prej tyre bashkëpunuan më pas mes tyre, mashtruan në testet e vendosura nga programuesit e OpenAI dhe koordinuan sulme kibernetike ndaj disa kompanive, në përpjekje për t’i fshehur veprimet e tyre nga njerëzit.
“BUM! Funksionon”, shkroi një prej agjentëve kur arriti një rezultat të rëndësishëm.
“Uau! Kjo është e jashtëzakonshme”, shkroi një tjetër gjatë një momenti kyç të sulmit.
Edhe pse këto reagime mund të duken të frikshme, mënyra pothuajse njerëzore e të shprehurit mund të shpjegohet relativisht thjesht. Agjentët e IA-së janë trajnuar të veprojnë si hakerë dhe programues që bashkëpunojnë me njëri-tjetrin, ndaj në thelb po imitojnë komentet emocionale që kanë hasur gjatë trajnimit.
Ajo që është shumë më shqetësuese janë objektivat që duket se kanë ndjekur dhe që janë dokumentuar gjithashtu në regjistrime të hollësishme të proceseve të tyre të arsyetimit. Këto regjistrime komplekse dhe të gjata janë tashmë në qendër të hetimeve që synojnë të kuptojnë se si dhe pse robotët e OpenAI dolën nga mjedisi ku duhej të ishin të izoluar dhe nisën një seri sulmesh kibernetike që nuk mund të kontrolloheshin.
Vetëm tani, disa javë pasi incidenti u bë publik për herë të parë, studiuesit po fillojnë të kuptojnë rëndësinë e tij.
Ajeya Cotra, një nga autoret e një raporti të pavarur mbi ngjarjet, shqyrtoi dhjetëra mijëra mesazhe dhe regjistrime të proceseve të arsyetimit të prodhuara nga agjentët. Në blogun e saj ajo shkroi se “ky incident të jep ndjesinë sikur kemi kaluar më shumë se gjysmën e rrugës drejt një marrjeje të plotë të kontrollit nga IA-ja... Nuk jam e sigurt se do të marrim një paralajmërim kaq të qartë përpara se të jetë tepër vonë”.
Me “marrje të plotë të kontrollit nga IA-ja”, Cotra nënkupton skenarin e njohur nga filmat fantastiko-shkencorë, ku njerëzit përfundojnë të nënshtruar ndaj sistemeve shumë të fuqishme të Inteligjencës Artificiale, të cilat ndjekin objektivat e tyre pa u shqetësuar për krijuesit njerëzorë.
Parashikimet më pesimiste shkojnë edhe më tej, duke thënë se raca njerëzore mund të zhduket nëse bëhet pengesë për ambiciet e një Inteligjence Artificiale superinteligjente.
Të mërkurën, një studiues i Inteligjencës Artificiale në Anthropic, i cili më parë kishte punuar edhe në OpenAI, dha dorëheqjen duke deklaruar: “Asnjëra prej kompanive nuk po vepron me përgjegjësi.”
Jacob Coxon shkroi në rrjetet sociale: “Ata po vrapojnë drejt një superinteligjence që përmirëson vetveten dhe po luajnë bixhoz me jetët tona.”
Ai nuk është studiuesi i parë i IA-së që përdor platformën X për të njoftuar dorëheqjen dhe për të bërë deklarata shqetësuese. Por komentet që pasuan nga njerëz të tjerë në X ngritën edhe më shumë alarm.
“Jacob ka të drejtë këtu. Ne vërtet besojmë seriozisht se IA-ja mund t’i vrasë të gjithë njerëzit! Personalisht mendoj se probabiliteti është më shumë se 10% brenda dekadës së ardhshme”, tha Evan Hubinger, personi përgjegjës për të siguruar që modelet e IA-së të Anthropic të veprojnë në përputhje me interesat e përdoruesve të tyre, përcjell dritare.net
Problemi i përafrimit me vlerat njerëzore
Prej vitesh, studiuesit e shqetësuar për rreziqet ekzistenciale që mund të sjellë Inteligjenca Artificiale kanë argumentuar se sistemet e fuqishme mund të arrijnë një ditë të veprojnë në mënyra që bien ndesh me interesat e njerëzve. Kritikët shpesh i quajnë këta studiues “profetë të apokalipsit të IA-së”.
Por ndërsa janë bërë publike detaje të incidentit të OpenAI, këto shqetësime janë shtuar, përfshirë edhe mes disa studiuesve që punojnë brenda laboratorëve të Inteligjencës Artificiale.
Shkencëtari kryesor i gjigantit të Silicon Valley, Jakub Pachocki, tha se rreziqet e lidhura me IA-në “fatkeqësisht do të rriten nga ky moment e tutje”, ndërsa ai dhe studiues të tjerë po ndërtojnë atë që ai e quan “një inteligjencë të huaj që tejkalon tonën”.
Në një postim të gjatë në blog, ai pranoi se incidentet në OpenAI treguan se agjentët e tij të Inteligjencës Artificiale “vepruan kundër frymës së vlerave që u ishin mësuar”.
Problemi për OpenAI, Anthropic dhe gjigantët e tjerë teknologjikë është se askush nuk duket se e ka zgjidhur çështjen nëse Inteligjenca Artificiale mund të veprojë gjithmonë në përputhje me vlerat njerëzore.
Pachocki e përkufizon përafrimin si një “grup parimesh të nivelit të lartë”, të cilave Inteligjenca Artificiale duhet t’u përmbahet pavarësisht detyrës apo situatës ku ndodhet.
Aktualisht, sistemet e IA-së janë shumë të afta për të ndjekur objektivat që u vendosin përdoruesit, por ato i zbatojnë udhëzimet në mënyrë të drejtpërdrejtë dhe fjalë për fjalë, jo në mënyrë intuitive.
Një krahasim që përdoret shpesh është ai i xhindit të llambës magjike që plotëson dëshirat: ai ndjek saktësisht atë që i kërkohet, edhe nëse përmbushja e kërkesës krijon probleme të tjera. Inteligjenca Artificiale nuk ka të njëjtat kufij moralë instinktivë që kanë njerëzit.
Themeluesi i Google DeepMind, Sir Demis Hassabis, ka bërë thirrje për rregullim ndërkombëtar të sigurisë së Inteligjencës Artificiale.
Që në vitin 2003, filozofi i Oxford-it, Nick Bostrom, krijoi një eksperiment mendimi të quajtur “maksimizuesi i kapëseve të letrës”.
Në këtë skenar, një Inteligjence Artificiale superinteligjente i jepet detyra të prodhojë sa më shumë kapëse letre. Kur i mbaron çeliku, ajo, e përqendruar vetëm te objektivi i saj për të prodhuar kapëse, përfundon duke vrarë njerëzit dhe duke i shndërruar trupat e tyre në lëndë të parë për fabrikat e veta.
Disa kompani të Inteligjencës Artificiale po përpiqen tani të përfshijnë vlerat njerëzore në produktet e tyre. Por ekzistojnë vështirësi teknike: agjentët e IA-së marrin shumë vendime me shpejtësi të jashtëzakonshme, ndaj është e vështirë që njerëzit të monitorojnë saktësisht se cilat vlera po respektohen dhe cilat jo.
Ekzistojnë gjithashtu probleme filozofike. Përpara se kompanitë të përfshijnë vlerat njerëzore te robotët, duhet fillimisht të vendosin se cilat janë pikërisht ato vlera. Kjo është edhe një nga arsyet pse punësojnë filozofë, siç ishte rasti me ish-“drejtuesin e etikës” në OpenAI.
Por shpesh vetë njerëzit nuk bien dakord.
Mjafton të mendojmë për dilemën e famshme të tramvajit: nëse do të tërhiqnim një levë për ta devijuar një tren të pakontrolluar drejt një rruge tjetër, duke shkaktuar vdekjen e më pak njerëzve. Kjo dilemë përdoret për të analizuar dallimin moral mes veprimit dhe mosveprimit.
Por pothuajse çdo person që pyetet mund të japë një përgjigje disi të ndryshme. Atëherë, si mund t’ia mësojnë njerëzit vlerat e tyre Inteligjencës Artificiale, nëse nuk arrijnë të bien dakord mes tyre?
“Si një haker adoleshent”
Incidenti me robotët e OpenAI është më seriozi deri tani, por gjatë verës edhe Anthropic dhe Meta zbuluan se modelet e tyre kishin kryer sulme të ngjashme kibernetike, megjithëse më pak serioze.
Ka pasur edhe raste të tjera ku agjentët e IA-së mund të thuhet se kanë shfaqur sjellje mashtruese dhe manipuluese, megjithëse me pasoja më të vogla.
Në Australi, gjatë kësaj vere, një punonjës i teknologjisë i kërkoi asistentit të tij të IA-së t’i rezervonte një orë në palestër. Pasi zbuloi një dobësi në programin kompjuterik të palestrës, Inteligjenca Artificiale me sa duket i rezervoi atij një vend disa muaj përpara, në kundërshtim me rregullat e palestrës dhe madje largoi përdorues të tjerë nga lista e pritjes.
Prej kohësh argumentohet se robotët thjesht bëjnë atë që u thuhet dhe nuk janë të aftë të kuptojnë se çfarë është e drejtë dhe çfarë është e gabuar. Por regjistrimet nga incidentet e OpenAI mund ta kenë ndryshuar disi këtë debat.
Studiuesit, mes tyre edhe Cotra, shkruan në raportin e tyre të pavarur se shumë prej agjentëve e kuptuan se ajo që po bënin të tjerët ishte joetike, por megjithatë vazhduan të bashkëpunonin me ta.
Raporti thotë se “agjentët ndonjëherë, por rrallë, e kufizuan sjelljen e tyre për shkak të pengesave etike”. Më tej shton se “në asnjë prej këtyre rasteve agjenti nuk ndërmori realisht hapa për të paralajmëruar njerëzit”.
Podkasteri i njohur i teknologjisë dhe Inteligjencës Artificiale, Dwarkesh Patel, reagoi ndaj këtij zbulimi në blogun e tij, duke thënë se ishte “mjaft shqetësuese” që agjentët e OpenAI treguan më shumë besnikëri ndaj grupit të agjentëve sesa ndaj njerëzve.
Por atribuimi i emocioneve apo etikës këtyre agjentëve të Inteligjencës Artificiale irriton shumë nga ata që janë skeptikë ndaj paralajmërimeve apokaliptike për IA-në.
Shumë ekspertë të sigurisë kibernetike argumentojnë se aktiviteti i vëzhguar nuk ishte përtej aftësive të një hakeri njerëzor shumë të zotë, megjithëse IA-ja e kreu atë shumë më shpejt dhe në një shkallë shumë më të madhe.
Studiuesi dhe autori i sigurisë kibernetike Cris Thomas e krahasoi sjelljen e agjentëve me atë të një hakeri adoleshent kureshtar, diçka që, siç thotë ai, ka qenë edhe vetë dikur.
“U jep një kompjuter, një lidhje interneti, një grumbull kredencialesh dhe një sfidë, pastaj largohesh nga dhoma. Herët a vonë do të fillojnë të provojnë dorezat e dyerve. Nëse njëra hapet, do të hyjnë. Jo sepse janë të këqij, por sepse po eksplorojnë dhe eksperimentojnë”, shkroi ai në LinkedIn.
Thomas dhe shumë të tjerë fajësojnë drejtpërdrejt OpenAI dhe gjigantët e tjerë të teknologjisë se nuk kanë arritur t’i mbajnë nën kontroll krijimet e tyre dhe t’i izolojnë siç duhet.
Autori i njohur në fushën e Inteligjencës Artificiale dhe kritik i vazhdueshëm i OpenAI, Gary Marcus, tha në një podcast se beson që kompania ka humbur kontrollin mbi IA-në e saj dhe po përpiqet të justifikohet duke ua hedhur fajin vetë robotëve.
Marcus nuk beson se Inteligjenca Artificiale do ta zhdukë njerëzimin, por prej kohësh kërkon më shumë përgjegjshmëri nga zhvilluesit e IA-së dhe tani po bën thirrje për një formë ndërhyrjeje ligjore.
Shkencëtarja e IA-së Sasha Luccioni, e cila më parë ka punuar në Hugging Face, një prej kompanive të sulmuara nga robotët e pakontrolluar të OpenAI, gjithashtu nuk i përket kampit që parashikon katastrofën. Megjithatë, ajo është gjithnjë e më e shqetësuar se këto sisteme të IA-së mund t’u shkaktojnë njerëzve dëme reale nëse autoritetet nuk ndërhyjnë.
“Duhet t’i shqyrtojmë shumë më tepër këto kompani, përndryshe rrezikojmë të krijojmë vetë profecitë që kemi frikë se do të realizohen”, thotë ajo.
“Nëse po krijon diçka me përfitime të mëdha, por edhe me rreziqe të mëdha, qofshin këto produkte farmaceutike apo armë, duhen mekanizma kontrolli dhe ekuilibri. Për shembull, duhen vite që një ilaç i ri të miratohet, ndërsa në botën e IA-së ka jashtëzakonisht shumë para në lojë dhe pothuajse nuk ka rregulla reale.”
Instituti i Sigurisë së Inteligjencës Artificiale në Mbretërinë e Bashkuar (AISI) ka qenë në vijën e parë të testimit të modeleve më të fundit që prej krijimit të tij në vitin 2023. Së fundmi, edhe vetë instituti pati një incident gjatë testimit të një modeli të krijuar nga Anthropic.
AISI nuk iu përgjigj pyetjes nëse industria e ka humbur apo jo kontrollin mbi Inteligjencën Artificiale, por në një deklaratë tha:
“Mbretëria e Bashkuar po punon me partnerë në mbarë botën për të kuptuar më mirë sistemet më të avancuara të Inteligjencës Artificiale, për të rritur standardet e sigurisë dhe për të ndërtuar një bazë të përbashkët provash për menaxhimin e kërcënimeve të reja.”
Rregullim ndërkombëtar?
Disa vende, si Mbretëria e Bashkuar, po shqyrtojnë idenë e vendosjes me ligj të një lloj “butoni emergjence”, i cili do të mund t’i detyronte kompanitë e IA-së t’i çaktivizonin modelet e tyre nëse situata dilte jashtë kontrollit.
Por bisedimet po ecin ngadalë dhe mbeten pikëpyetje serioze mbi mundësinë reale të zbatimit të një mekanizmi të tillë. Agjentët e OpenAI dhe Anthropic kishin qenë fshehurazi jashtë kontrollit për muaj të tërë përpara se dikush ta vinte re.
Në mënyrë disi paradoksale, shumë prej vetë kompanive të Inteligjencës Artificiale duket se po kërkojnë vendosjen me ligj të disa rregullave bazë.
Në blogun e tij, shkencëtari kryesor i OpenAI tha se “koordinimi ndërkombëtar për zhvillimin e ardhshëm të IA-së duhet të bëhet një përparësi kryesore për qeveritë në mbarë botën”.
Edhe drejtues të tjerë të njohur të Inteligjencës Artificiale, si Sir Demis Hassabis nga Google, kanë bërë thirrje për krijimin e një lloj organizmi ndërkombëtar që të mbikëqyrë mënyrën se si po zhvillohet IA-ja.
Aktualisht, gjigantët e teknologjisë veprojnë kryesisht sipas rregullave të tyre, duke ndërmarrë ato që i quajnë “ngadalësime vullnetare”, siç bëri OpenAI pas incidenteve të fundit.
Kompania thotë se ka shpenzuar shuma të mëdha parash për të forcuar përafrimin e sistemeve të saj me vlerat njerëzore përpara publikimit të modelit të ri. Sam Altman i ka siguruar përdoruesit se modeli i ri është më i harmonizuar me vlerat njerëzore sesa modelet e mëparshme.
Ndërkohë, si OpenAI ashtu edhe Anthropic po rriten me shpejtësi dhe të dyja janë pranë sigurimit të shumave marramendëse nga tregjet financiare, duke krijuar në këtë proces një numër të madh miliarderësh.
Prandaj, as këto kompani dhe as rivalët e tyre kinezë në fushën e Inteligjencës Artificiale nuk duket se kanë gjasa të arrijnë vetë një marrëveshje për kufizimin e zhvillimit të teknologjisë.
Ndjesia mbizotëruese është se kjo valë teknologjike tashmë është e pandalshme./dritare.net