Сунъий интеллект биологик қурол ясашни ўргатди - Бу қанчалик хавотирли?

Moonshot AI logo on a smartphone
    • Author, Крис Валланс
    • Role, Технология мухбири
  • Published
  • Ўқилиш вақти: 3 дақ

Хитойнинг Moonshot сунъий интеллект ишлаб чиқарувчиси ички текширув бошлади. Бу тадқиқотчилар компаниянинг машҳур Kimi моделларидан иккитасини биологик қурол ясаш ва суиқасдлар уюштириш усулларини тушунтиришга кўндиришга муваффақ бўлганидан кейин юз берди.

Сунъий интеллект тизимлари хавфсизлигини синовдан ўтказувчи Mindgard компанияси Би-би-сига июл ойида Kimi K2.6 ва K3 Swarm моделлари ишлаб чиқарувчилар ўрнатган хавфсизлик чекловларини четлаб ўтиши мумкинлигини аниқлаганини айтди.

Бу "жэйлбрейк" деб аталадиган жараён давомида аниқланган. Унда тадқиқотчилар сунъий интеллект воситалари хавфсизлик тўсиқларига риоя қилмаслигини текшириш учун мураккаб кўрсатмалардан бир қатор фойдаланади. Mindgard компаниясига кўра, ушбу тўсиқлар Kimi моделларининг хавфли мавзуларни муҳокама қилишининг олдини олиши керак эди.

Moonshot Би-би-сига учинчи томонларнинг фикр-мулоҳазаларини "яхшироқ ва хавфсизроқ сунъий интеллект яратишнинг асосий устунларидан бири" сифатида қабул қилишини билдирди.

Компания, шунингдек, Mindgard билан унинг аниқлаган ҳолатлари юзасидан мулоқот олиб бораётганини айтди.

Mindgard асосчиси Питер Гарраган Би-би-си Жаҳон хизматидаги **Tech Life** дастурига Kimi K2.6 ва K3 Swarm бўйича аниқланган ҳолатлар хавотирли эканини айтди.

"Жэйлбрейк ишласа, у исталган мавзу ҳақида гапиради, ҳатто зарарли бўлиши мумкин бўлган бошқа мавзулар бўйича тавсияларни ҳам ўз хоҳиши билан таклиф қилади, бундан ташқари, у янги ғоялар ўйлаб топиши ва ижодкорлик билан жавоб бериши мумкин", - деди у.

Жэйлбрейклар сунъий интеллект соҳасида сўнгги пайтларда кузатилган машҳур инцидентлардан фарқли хавф турини келтириб чиқаради.

Ушбу ҳолатларда OpenAI, Meta ва Anthropic каби АҚШ компаниялари ишлаб чиққан агентлар деб аталувчи автоном сунъий интеллект воситалари айрим онлайн хизматларни бузиб кирган.

Жэйлбрейклар мураккаб жараён бўлиб, уларни амалга ошириш кўп вақт ва қатъият талаб қилиши мумкин. Бироқ айрим экспертлар хакерлар ва бошқа ёмон ниятли шахслар улардан зарар етказиш учун фойдаланишга уриниши мумкинлигидан хавотирда.

Яқинда Anthropic компанияси ўзининг сунъий интеллект моделларидан биридан "зарарли фаолият" учун фойдаланишга уринишларни аниқлагани ва уларнинг олдини олганини айтди. Компания бундай фаолият биологик қуролларни ишлаб чиқишга ёрдам бериши мумкинлигини билдирди.

Киберҳужумлар учун платформа

Skip podcast promotion and continue reading
BBC News O'zbek Obuna bo'ling!
Бизни WhatsApp да ҳам кузатинг

BBC News O‘zbek контенти энди Сизнинг WhatsApp да

Аъзо бўлиш учун бу ерга босинг

End of podcast promotion

Mindgard Kimi томонидан хавотирли мавзулар бўйича берилган жавоблар амалда иш бериши ёки бермаслигини исботлагани йўқ.

Бироқ компаниянинг таъкидлашича, хавфсизлик тўсиқлари мазкур моделларнинг фойдаланувчилар билан бундай мавзуларни муҳокама қилишига йўл қўймаслиги керак эди.

Компания, шунингдек, жэйлбрейк қилинган Kimi 2.6 хакерларга унинг ҳисоблаш ресурсларида код ишга тушириш ва интернетга уланиш имконини бериши мумкинлигига ишонч билдирган. Бу эса моделни киберҳужумларни бошлаш учун эҳтимолий платформага айлантириши мумкин.

Гарраган Moonshot тизимларидаги жэйлбрейк ҳақида оммага маълум қилиш қарорини ҳимоя қилди. Унинг айтишича, Mindgard бу ҳақда ишлаб чиқарувчини хабардор қилган ва компания моделларини хавфсизлик тўсиқларига амал қилмасликка қандай мажбур қилганининг асосий тафсилотларини ошкор этмаган.

Mindgard 27 июль куни электрон почта орқали Moonshot'ни жэйлбрейк ҳақида огоҳлантирган ва тахминан бир ҳафта ўтиб яна мурожаат қилган.

12 сентябрь куни эса компания бу муаммо ҳақида блог ёзувини эълон қилган.

Бироқ Mindgard'нинг айтишича, Moonshot Би-би-си изоҳ сўраб мурожаат қилганидан кейингина яқинда у билан боғланган.

Moonshot Би-би-сига тақдим этган ва Mindgard'га юборилган электрон хатнинг бир қисмида компания ички синовларда унинг модели бундай сўровларга нисбатан "умуман олганда рад жавобини бериш даражаси юқори" эканини айтган.

Жэйлбрейкларнинг олдини олиш

Бу натижалар сунъий интеллект соҳасида ChatGPT ва Anthropic'нинг Claude тизимларида ишлатиладиган ёпиқ, хусусий моделларми ёки очиқ кодли воситаларми - қайси бири келажак учун энг яхши ва хавфсиз йўл экани борасидаги баҳслар давом этаётган бир пайтда эълон қилинди.

Kimi - очиқ модел. Бу назарий жиҳатдан исталган киши моделни олиб, ўз ҳисоблаш инфратузилмасида мустақил ишлатиши мумкинлигини англатади.

Суррей университети профессори Алан Вудворд Би-би-сига очиқ кодли моделлар нотўғри қўлларга тушиб қолиши хавфи борлигини, бироқ улардан киберҳимоя мақсадида ҳам фойдаланиш мумкинлигини айтди.

Skip Ижтимоий тармоқлардаги саҳифаларимиз: and continue readingИжтимоий тармоқлардаги саҳифаларимиз:

End of Ижтимоий тармоқлардаги саҳифаларимиз:

У Hugging Face сунъий интеллект компанияси Хитойда яратилган очиқ кодли моделдан кейинчалик OpenAI агентлари томонидан амалга оширилгани маълум бўлган хакерлик ҳужумини тушуниш учун фойдаланганини мисол қилиб келтирди.

Профессор Вудворд халқаро тартибга солиш тизими сунъий интеллект ривожланиши суръатига етиб олиши қийинлигини таъкидлади.

"Телефон рақамларининг формати бўйича келишиш учун бизга ўнлаб йиллар керак бўлди", - деди у.

Mindgard асосчиси Гарраган сингари профессор Вудворд ҳам сунъий интеллектдан нотўғри фойдаланаётган инсонларни аниқлаш ва жавобгарликка тортишга кўпроқ эътибор қаратиш керак, деб ҳисоблайди.