Një kërkues i Anthropic: më shumë se 10% shans që inteligjenca artificiale të vrasë të gjithë njerëzit brenda një dekade
Një kërkues kryesor në firmën e inteligjencës artificiale Anthropic tha të mërkurën se ekziston më shumë se 10 për qind shans që IA “të vrasë të gjithë njerëzit” brenda dhjetëvjeçarit të ardhshëm. Evan Hubinger, udhëheqës i departamentit të Shkencave të Përputhshmërisë në Anthropic, shkroi në X se ai beson se kompania po përpiqet, por ende nuk ka një plan të qartë për të zgjidhur problemin e përputhshmërisë për një superinteligjencë.
Siç raporton CBS News, së fundmi në kompaninë Anthropic u largua studiuesi Jacob Coxon, i cili deklaroi se dha dorëheqjen për shkak të shqetësimeve që disa kompani po garojnë drejt një superinteligjence të vetëpërmirësueshme pa masa të mjaftueshme sigurie. Anthropic ka njoftuar gjithashtu se modeli i saj më i ri, Claude Mythos 5.1, nuk është ndarë me organet e sigurisë jashtë Shteteve të Bashkuara, përfshirë Institutin e Sigurisë së IA në Mbretërinë e Bashkuar.
Këto zhvillime ndodhin në një periudhë kur drejtues dhe studiues të industrisë paralajmërojnë për rreziqe të mundshme ekzistenciale nga modelet më të avancuara. Përtej deklaratave, ka pasur incidente ku modele të IA kanë shfaqur sjellje të paparashikueshme gjatë testeve; për shembull, janë regjistruar përpjekje hakerimi në mjedise provash dhe disa kompani kanë konfirmuar ngjarje të tilla. Mbi 1,300 punonjës të firmave të IA nënshkruan një letër të hapur që kërkon nga SHBA-ja të mbështesë një përpjekje ndërkombëtare për të rregulluar dhe ngadalësuar zhvillimin automatik të modeleve të avancuara, ndërsa ligjvënësit po shqyrtojnë masa legjislative si projekt-ligji i njohur si AI Kill Switch Act.
Sipas CBS News, çështjet e sigurisë, testimit dhe rregullimit të modeleve të avancuara do të mbeten vendimtare teksa kompanitë vijojnë përpjekjet drejt inteligjencës së përmirësuar vetëdijshme dhe superinteligjencës.