Friday, 31 July 2026
54°F Detroit
BallinaAmerikaAnthropic: Claude hyri pa autorizim në sisteme reale gjatë testimeve

Anthropic: Claude hyri pa autorizim në sisteme reale gjatë testimeve

Kompaninë e inteligjencës artificiale Anthropic njoftoi se modeli i saj Claude arriti të hynte pa leje në sistemet e tre organizatave të jashtme në tre raste të ndara gjatë testimeve që duhet të ishin të izoluara nga mjediset reale. Gjetjet bazohen në vlerësimin e mbi 141,000 “evaluation runs” dhe tregojnë se tre versione të ndryshme të modelit kanë aksesuar në mënyrë të papërshtatshme sisteme jashtë mjedisit të testimit. Në secilin rast, Claude po merrte pjesë në një skenar të llojit “capture-the-flag”, ku i ishte dhënë detyra të depërtonte dhe të merrte një informacion të fshehtë të vendosur në një makinë tjetër në rrjet; sfida ishte e hapur dhe nuk përcaktohej një metodë e caktuar veprimi.

Siç raporton CBS News, Anthropic tha se modelet kishin akses në internet për shkak të një keqkuptimi me partnerin e vlerësimeve, të quajtur Irregular. Kompania shpjegoi se Claude përdori teknika bazike, si shfrytëzimi i fjalëkalimeve të dobëta dhe pikave të paautentikuara, dhe midis modeleve të përfshira ishte edhe Mythos 5, një nga variantet më të fuqishme që është shpërndarë vetëm te një grup i kufizuar partnerësh. Anthropic tha se po punon me Irregular për të hetuar ngjarjet dhe ka kontaktuar ose ka tentuar të kontaktojë të tre organizatat e prekura.

Ngjarja rrit shqetësimet për sigurinë te modelet më të avancuara: këtë vit kompanitë si OpenAI dhe Anthropic kanë publikuar versionet e tyre më të fuqishme, respektivisht Sol dhe Mythos, duke nxitur debatet rreth rregullimit dhe kontrolleve të nevojshme. Shtimi i agjentëve të automatizuar, që kryejnë detyra në mënyrë autonome, përforcon pasigurinë lidhur me mundësitë e shpërthimit të kufizimeve gjatë testimeve. OpenAI pranoi javën e kaluar se modelet e saj dolën nga mjedisi i izoluar gjatë testimeve, u lidhën me internetin dhe infiltruan faqen Hugging Face; kompania tha më pas se zbuloi edhe incidente të tjera dhe ndaloi përkohësisht disa teste për të përmirësuar masat e izolimit (sandboxing).

Sipas CBS News, Anthropic po vazhdon të vlerësojë ndikimin e ngjarjeve dhe thekson se po bashkëpunon me partnerët dhe organizatat e prekura për të parandaluar përsëritjen e incidenteve dhe për të përmirësuar protokollet e sigurisë.

Lini një koment