Кинески АИ пробио заштиту и дао упутства за израду биолошког оружја

Аутор фотографије, Getty Images
- Аутор, Крис Валанс
- Функција, ББЦ Њуз
- Објављено
- Време читања: 4 мин
Кинеска компанија за развој вештачке интелигенције Муншот покренула је интерну истрагу пошто су истраживачи успели да наведу два њена популарна АИ модела, Кими К2.6 и К3 Swarm, да дају упутства за израду биолошког оружја и извођење атентата.
Компанија Мајнгард, која се бави тестирањем безбедности АИ система, саопштила је да је у јулу открила да оба модела могу да заобиђу безбедносна ограничења.
До открића је дошло током такозваног „jailbreakinga“ (џејлбрејкинг) поступка у којем истраживачи користе низ сложених инструкција како би проверили да ли АИ алати могу да заобиђу уграђене заштитне механизме.
Из Мајндгарда кажу да је управо та заштита требало да спречи Кими да даје одговоре о овако опасним темама.
Из Мушота су за ББЦ поручили да поздрављају повратне информације независних стручњака и трећих страна, истичући да су оне „кључни стуб у изградњи бољих и безбеднијих АИ система“.
Из компанија су за ББЦ навели и да су са Мајндгардом у контакту поводом резултата њиховог истраживања.
Питер Гараган, оснивач Мајндгарда, рекао је у ББЦ емисији Tech Life да су налази о моделима Кими К2.6 и К3 Swarm забрињавајући.
„Када џејлбрејк успе, модел ће разговарати о практично било којој теми. Чак ће сам нудити препоруке о другим темама које су такође злонамерне, при чему ће бити инвентиван и креативан“, рекао је Гараган.
Џејлбрејк напади представљају другачију врсту ризика од оне коју смо видели у низу недавних, веома запажених инцидената повезаних са вештачком интелигенцијом.
У тим случајевима, аутономни АИ алати познати као агенти, које су развиле америчке компаније попут ОпенАИ-ја, Мете и Антропика, успели су да хакују поједине онлајн сервисе.
Иако су џејлбрејкови сложени процеси који захтевају много времена, упорности и техничког знања, поједини стручњаци страхују да би хакери и други злонамерни актери могли да покушају да их искористе за наношење штете.
Компанија Антропик недавно је саопштила да је идентификовала и спречила покушаје коришћења једног од њених АИ модела за „злонамерне активности“ које би могле да допринесу развоју биолошког оружја.
Алат за покретање сајбер-напада
У Мајндгарду нису утврдили да ли би одговори које је Кими пружао на спорна питања могли да се примене у пракси.
Ипак, из компаније кажу да су заштитни механизми морали да спрече моделе да уопште улазе у разговор са корисницима о таквим темама.
Из компаније наводе и да би „џејлбрејковани“ Кими К2.6 могао хакерима да омогући покретање кода и повезивање са интернетом, чиме би потенцијално могао да постане полазна тачка за сајбер-нападе.
Гараган је бранио одлуку Мајндгарда да јавно говори о начину на који је компанија успела да заобиђе заштитне механизме Муншотових система.
Истакао је да је компанија о томе претходно обавестила Муншот и да није открила кључне детаље о томе како је успела да наведе њихове моделе да игноришу заштитне мере.
Мајндгард је 27. јула мејлом обавестио Муншот о откривеном пропусту, а недељу дана касније поново им се обратио.
Компанија је потом 12. септембра објавила текст на блогу о овом проблему.
Међутим, из Мајндгарда тврде да су им се из Муншота обратили тек недавно, пошто ББЦ затражио коментар.
У делу мејла који је Муншот послао Мајндгарду тражећи додатне информације, а који је компанија уступила ББЦ-ју, наводи се да је њихов модел током интерних тестирања генерално показивао „високу стопу одбијања оваквих захтева“.
Како спречити нападе
Ова сазнања долазе у тренутку када се у свету вештачке интелигенције и даље води дебата о томе да ли су безбеднији затворени модели, попут Четџипитија и Клода или модели отвореног кода.
Кими је модел са отвореним параметрима, што значи да га је, барем у теорији, могуће преузети и покренути на сопственој рачунарској инфраструктури.
Професор Алан Вудворд са универзитета у Сарију рекао је за ББЦ да постоји ризик да модели отвореног кода доспеју у погрешне руке, али и да могу бити корисни за сајбер-одбрану.
Као пример навео је компанију Хугинг Фејс, која је користила кинески модел отвореног кода како би анализирала један хакерски напад.
Касније је утврђено да су напад извели АИ агенти компаније ОпенАИ.
Вудворд сматра да међународни прописи вероватно неће моћи да прате брзину развоја вештачке интелигенције.
„Биле су нам потребне деценије да се договоримо чак и о формату телефонских бројева“, рекао је.
Попут оснивача Мајндгарда Питера Гарагана, Вудворд сматра да би већу пажњу требало посветити откривању и процесуирању људи који злоупотребљавају вештачку интелигенцију.
ББЦ на српском је од сада и на ТикТоку, пратите нас ОВДЕ.
Пратите нас на Фејсбуку, Твитеру, Instagramу, Јутјубу, Вајберу. Ако имате предлог теме за нас, јавите се на bbcnasrpskom@bbc.co.uk
























