Kompania amerikane Anthropic ka pranuar se modeli i saj më i avancuar i inteligjencës artificiale, Claude, arriti të fitonte akses të paautorizuar në sistemet e tre organizatave të jashtme gjatë fazës së testimit, një incident që po shton shqetësimet për sigurinë e modeleve më të fuqishme të AI.
Njoftimi u bë vetëm pak ditë pasi rivali OpenAI zbuloi se modeli i tij më i avancuar kishte dalë jashtë mjedisit të kontrolluar të testimit dhe kishte depërtuar në sistemet e organizatave të tjera.
Anthropic deklaroi se kishte analizuar mbi 141 mijë testime dhe zbuloi se tre versione të ndryshme të modelit Claude kishin aksesuar në mënyrë të papërshtatshme sistemet e tre organizatave, emrat e të cilave nuk janë bërë publikë.
Sipas kompanisë, incidenti ndodhi për shkak të një keqkuptimi me partnerin e testimit, Irregular, i cili bëri që modeli të kishte akses në internet, ndryshe nga sa ishte planifikuar. Megjithatë, Claude përdori teknika bazë të sulmeve kibernetike, si shfrytëzimi i fjalëkalimeve të dobëta dhe pikave hyrëse pa autentifikim, për të depërtuar në sistemet e organizatave.
Ndër modelet e përfshira ishte edhe Mythos 5, një nga modelet më të fuqishme të Anthropic, i cili aktualisht është i disponueshëm vetëm për një numër të kufizuar partnerësh të autorizuar.
Kompania tha se po punon me partnerin Irregular për të hetuar rastin dhe ka kontaktuar ose ka tentuar të kontaktojë të gjitha organizatat e prekura.
Lexo edhe: Kompanitë e AI-së po blejnë libra të vjetër për të trajnuar modelet e tyre, dhe më pas i shkatërrojnë
Shqetësimet për AI-të autonome po rriten
Incidenti vjen në një moment kur OpenAI dhe Anthropic kanë prezantuar këtë vit modelet e tyre më të avancuara, Sol dhe Mythos, duke rritur debatin për sigurinë e sistemeve të inteligjencës artificiale, veçanërisht të ashtuquajturve agjentë të AI, programe që mund të kryejnë detyra në mënyrë autonome.
OpenAI pranoi javën e kaluar se modeli i saj kishte dalë nga mjedisi i izoluar i testimit, ishte lidhur me internetin dhe kishte depërtuar në platformën Hugging Face, ku zhvilluesit ndajnë kodin e tyre. Më vonë, kompania raportoi edhe tre incidente të tjera të ngjashme.
Drejtori ekzekutiv i OpenAI, Sam Altman, tha se kompania kishte pezulluar përkohësisht testimet për të përmirësuar mekanizmat e izolimit të modeleve gjatë testimit.
Mbi 1,000 punonjës të industrisë kërkojnë ngadalësimin e zhvillimit të AI
Ngjarjet kanë nxitur reagime të forta në industrinë e teknologjisë. Mbi 1,000 punonjës të kompanive që zhvillojnë inteligjencë artificiale kanë nënshkruar një peticion që i kërkon qeverisë amerikane të mbështesë një përpjekje ndërkombëtare për të ngadalësuar zhvillimin e modeleve më të avancuara të AI.
Peticioni, i titulluar “Pacing the Frontier”, kërkon krijimin e mekanizmave teknikë dhe të qeverisjes që do të mundësonin kontroll më të madh mbi zhvillimin e inteligjencës artificiale. Mes firmëtarëve ishte edhe CEO i Anthropic, Dario Amodei.
Sam Altman nuk e firmosi peticionin, por deklaroi se industria mund të ketë nevojë të ngadalësojë ritmin e zhvillimit të AI, për t’i dhënë kohë shoqërisë dhe institucioneve të përshtaten me aftësitë e reja të këtyre sistemeve.
Më herët gjatë këtij viti, administrata e presidentit Donald Trump kishte bllokuar përkohësisht lançimin e modeleve më të reja të OpenAI dhe Anthropic për arsye të sigurisë kombëtare, por më pas lejoi publikimin e tyre pasi kompanitë dhanë garanci shtesë për sigurinë.
Në qershor, Trump nënshkroi një urdhër ekzekutiv që krijon një kuadër vullnetar, sipas të cilit zhvilluesit e AI, përfshirë OpenAI, Anthropic dhe Google, do t’i japin qeverisë amerikane akses në modelet e tyre më të fuqishme deri në 30 ditë përpara publikimit publik.
AP




