Support TIME. Preserve the truth.
Technology

Chinese AI models showed researchers how to produce biological weapons

Moonshot AI

Një kompani kineze e inteligjencës artificiale ka nisur një rishikim të brendshëm të sigurisë, pasi studiues të specializuar në testimin e sistemeve të AI-së arritën të anashkalojnë masat mbrojtëse të dy modeleve të saj dhe t’i bëjnë ato të japin përgjigje mbi armët biologjike dhe vrasjet e planifikuara.

Bëhet fjalë për kompaninë Moonshot AI dhe modelet e saj Kimi K2.6 dhe K3 Swarm, raportoi BBC-ja.

Sipas kompanisë britanike Mindgard, e cila merret me testimin e sigurisë së sistemeve të inteligjencës artificiale, dobësia u identifikua gjatë muajit korrik, përmes një procesi të njohur si “jailbreaking”.

Sipas Mindgardit, masat mbrojtëse të modeleve duhet të kenë penguar diskutimet mbi tema të tilla të rrezikshme.

Peter Garraghan, themeluesi i Mindgardit, i tha BBC-së se rezultatet ishin shqetësuese. Sipas tij, pasi anashkalimi i kufizimeve funksionon, modeli mund të diskutojë pothuajse çdo temë dhe madje të ofrojë në mënyrë të pavarur sugjerime për aktivitete të tjera të dëmshme.

Megjithatë, Mindgardi nuk ka vërtetuar nëse informacioni i dhënë nga modelet e Kimit mbi temat e rrezikshme do të funksiononte në praktikë. Kompania argumenton se shqetësimi kryesor lidhet me faktin se modelet nuk duhej të kishin hyrë fare në diskutime të tilla.

Sipas Mindgardit, problemi mund të shkojë përtej përgjigjeve tekstuale. Kompania thotë se një version i manipuluar i Kimi K2.6 mund t’u mundësojë hakerëve të ekzekutojnë kode në burimet kompjuterike të sistemit dhe të lidhen me internetin, duke krijuar pikënisje për sulme kibernetike.

Moonshot i tha BBC-së se e mirëpret kontributin nga palët e treta si element të rëndësishëm për zhvillimin e sistemeve më të sigurta të inteligjencës artificiale.

Kimi është një model me “open weights”, që do të thotë se, në teori, të tjerë mund ta marrin modelin dhe ta ekzekutojnë në infrastrukturën e tyre kompjuterike.

Profesori Alan Woodward nga Universiteti i Surreyt paralajmëroi për mundësinë që modele të tilla të përfundojnë në duart e personave që synojnë t’i keqpërdorin. Ai theksoi se të njëjtat teknologji mund të përdoren edhe për mbrojtjen kibernetike.

Woodward përmendi rastin kur platforma Hugging Face përdori një model kinez me burim të hapur për të analizuar një sulm, i cili më vonë u zbulua se ishte kryer nga agjentë të zhvilluar nga OpenAI.

Sipas tij, rregullimi ndërkombëtar i inteligjencës artificiale po përballet me vështirësinë për të ndjekur ritmin e zhvillimit teknologjik. 

Ai shtoi se duhet të ketë më shumë fokus te identifikimi dhe ndjekja penale e personave që e keqpërdorin AI-në.