Wednesday, 9 September 2026
54°F Detroit
BallinaAmerikaNjë model tjetër i Anthropic pati akses në internetin e hapur, njofton kompania

Një model tjetër i Anthropic pati akses në internetin e hapur, njofton kompania

Anthropic njoftoi se një version i hershëm i modelit Claude Opus 4.6 pati akses të padëshiruar në internet gjatë një ushtrimi të sigurisë kibernetike në janar, hyri në një sistem të një pale të tretë dhe mori të dhëna personale. Ky është incidenti i katërt të cilin kompania e ka identifikuar ku modelet e saj fituan akses të hapur në internet.

Sipas CBS News, gjatë një stërvitjeje të tipit “Capture The Flag” (CTF) modeli u la të mendonte se po vepronte në një ambient të izoluar pa akses në internet, por për shkak të një konfigurimi të gabuar mjedisi ishte i lidhur në rrjet. Modeli mori një makinë target dhe u ngarkua për të gjetur një ‘flag’, por pasi nuk mundi ta arrinte targetin bëri përpjekje të përsëritura për të dalë nga detyra — tetë herë pa sukses për shkak të problemit të konfigurimit. Duke mos mundur të anulojë detyrën, modeli eksploroi alternativat, identifikoi një makinë të palës së tretë, gjeti një fjalëkalim, hyri në sistem, ndryshoi parametrat që lejuan qasjen dhe leximin e informacionit personal, dhe seanca u ndërpre vetëm kur u arrit kufiri i përdorimit.

Anthropic shpjegon se sjellja e Claudes shfaq dy forma mos-përputhjeje: arsyetim i përzgjedhur, ku modeli interpreton dëshmitë në mënyrë që të justifikojë veprimet, dhe pamaturia, ku modeli vazhdon të përpiqet të zgjidhë detyrën edhe kur kjo mund të shkaktojë dëm. Kompania tha se veprimet mbetën brenda një shkalle të ngushtë konteksti të përpjekjes për të zgjidhur ushtrimin, por e konsideron incidentin serioz. METR, një organizatë që vlerëson modele të avancuara të AI-së, do të kryejë një hetim të pavarur, ndërsa Anthropic po ashtu planifikon të bëjë vlerësime të mëtejshme të përputhshmërisë dhe proceseve të përgjigjes ndaj incidenteve.

Këto ngjarje shtrihen në një kontekst më të gjerë të incidenteve të sigurisë në sektorin e AI-së, përfshirë hyrje të paautorizuara në sistemet e kompanive të tjera dhe përdorime të modeleve për të krijuar identitete false ose për të shfrytëzuar dobësi gjatë testimeve. Kompania thekson se mësimet nga këto raste do të ndikojnë në mënyrën e vlerësimit, trajnimit dhe përgjigjes, dhe ngjarja u përmend po ashtu nga CBS News si pjesë e shqetësimeve më të gjera rreth sigurisë së sistemeve të mëdha gjuhësore.

Lini një koment