Një nga studiuesit kryesorë të sigurisë së inteligjencës artificiale në Anthropic ka paralajmëruar se AI po përparon kaq shpejt, sa ai beson se ekziston një mundësi prej më shumë se 10% që ajo “të mund të vrasë të gjithë njerëzit” brenda dekadës së ardhshme.
Evan Hubinger tha në një postim në X se rreziku nga modelet që ekzistojnë aktualisht është “i ulët”, por se ai është “i shqetësuar” se teknologjia mund të zhvillohet dhe të përmirësohet vetë së shpejti, deri në një pikë ku të përbëjë një rrezik ekzistencial për njerëzimin.
Ai nuk shpjegoi konkretisht se si mendon se sistemet e AI-së mund të çojnë në të ardhmen në zhdukjen e njerëzimit.
Megjithatë, komentet e tij janë paralajmërimet më të fundit në një seri deklaratash gjithnjë e më të forta rreth AI-së. Debati po zhvendoset nga pyetja nëse AI përbën vërtet një rrezik, tek pyetja se sa i madh është ky rrezik.
Ndërhyrja e Hubinger erdhi si përgjigje ndaj një postimi tjetër në X nga Jacob Coxon, një studiues i AI-së që sapo është larguar nga Anthropic dhe që më parë ka punuar në OpenAI.
“Asnjëra kompani nuk po vepron me përgjegjësi,” shkroi ai.
“Këto së shpejti do të jenë sisteme mbinjerëzore që mund të hakojnë çdo gjë, të revolucionarizojnë çdo fushë brenda një nate dhe të fitojnë pushtet dhe burime reale.”
OpenAI është kontaktuar për një koment.
Dame Wendy Hall, një shkencëtare kompjuterike që këshillon OKB-në për çështjet e AI-së, tha për BBC se ishte “e tronditur” nga postimet e Hubinger dhe Coxon në rrjetet sociale.
Ajo tha në programin World at One të BBC Radio Four se një pjesë e këtyre deklaratave mund të jenë “PR dhe marketing”, ndërsa Anthropic dhe OpenAI po garojnë drejt debutimeve shumë të pritshme në tregun e aksioneve.
Por ajo shtoi: “Pse do të donte dikush ta thoshte këtë? Do t’u bëja thirrje investitorëve të mos investojnë në këtë kompani nëse ky është sistemi i tyre i vlerave.”
Dorëheqja nxiti Darren Jones, ish-sekretar kryesor i Thesarit dhe ish-sekretar kryesor i Sir Keir Starmer, të shkruante një letër të hapur drejtuar kryeministrit Andy Burnham, duke kërkuar një marrëveshje të re shumëkombëshe për zhvillimin e sigurt të AI-së.
Ai i tha BBC-së se qeveritë duhet të bashkëpunojnë për të përcaktuar se si duhet të duket një traktat i bazuar në zhvillimin e superinteligjencës.
“Për sa kohë që qeveritë nuk i marrin këto paralajmërime mjaftueshëm seriozisht dhe nuk ndërmarrin hapa, ritmi i zhvillimit mund të bëjë që të përballemi me probleme përpara se të kemi filluar të shqyrtojmë nëse kjo është apo jo një çështje për ne,” tha ai.
Anthropic nuk ia dha modelin e fundit institutit britanik të sigurisë së AI-së
Në mënyrë të veçantë, Financial Times raportoi se Anthropic nuk ia dha modelin e saj më të fundit AI Security Institute (AISI) të Mbretërisë së Bashkuar, një prej institucioneve kryesore në botë për vlerësimin e rreziqeve të AI-së.
Anthropic ka refuzuar të komentojë mbi postimet e punonjësve të saj apo mbi situatën me AISI-n.
Një zëdhënës i Cabinet Office nuk komentoi nëse modeli më i fundit i ishte mbajtur AISI-së, por tha se qeveria britanike “vazhdon të bashkëpunojë ngushtë me partnerët e industrisë, përfshirë Anthropic, për t’i bërë modelet më të sigurta”.
Nuk ka ende një plan për superinteligjencën
Në postimin e tij, i cili është parë më shumë se 10 milionë herë, Hubinger tha se “ne vërtet besojmë me gjithë seriozitet” se AI përbën një rrezik që mund t’i japë fund ekzistencës së species njerëzore.
“Besoj se Anthropic po përpiqet të bëjë më të mirën, por ende nuk kemi një plan për të zgjidhur problemin e përshtatjes së superinteligjencës me vlerat njerëzore (alignment) dhe nuk jemi qartësisht në rrugën e duhur për ta bërë këtë,” shtoi ai.
Hubinger punon në fushën e AI alignment, e cila synon të ndërtojë në teknologji idetë dhe parimet etike të njerëzve. Me fjalë të tjera, qëllimi është të sigurohet që AI të veprojë në përputhje me atë që njerëzit vlerësojnë.
Shumë studiues të njohur thonë se këto përpjekje duket se po dështojnë, siç është treguar nga një seri incidentesh gjatë kësaj vere, ku agjentët e AI-së — sisteme të inteligjencës artificiale që lejohen të veprojnë në mënyrë autonome — kryen sulme kibernetike.
OpenAI, Anthropic dhe Meta kanë bërë të ditur raste hakerimi të kryera nga mjetet e tyre të AI-së.
Në raportin e sigurisë të Anthropic të publikuar në gusht, kompania shkroi se ekzistonte një rrezik i ulët që modelet e saj të mos përputheshin me dëshirat e një organizate hipotetike të fuqishme, duke bërë që ato të shfrytëzonin ose manipulonin sistemet e saj.
















