Қытайлық жасанды интеллект қауіпсіздік сынағы кезінде биологиялық қару туралы ақпарат берген
Қытайдың Moonshot компаниясы әзірлеген Kimi жасанды интеллект модельдерінен қауіпсіздік тесті кезінде биологиялық қару жасау және адамға зиян келтіру жолдары туралы қауіпті ақпарат алынған. Осыдан кейін компания ішкі тексеріс бастаған. Бұл туралы Stan.kz ақпарат агенттігі BBC-ге сілтеме жасап хабарлайды.
Жасанды интеллект жүйелерінің қауіпсіздігін тексерумен айналысатын Mindgard компаниясының мамандары Kimi K2.6 және K3 Swarm модельдерінің қорғаныс шектеулерін айналып өтуге болатынын анықтаған.
Зерттеушілер мұндай осалдықты шілде айында байқаған. Олар “джейлбрейк” деп аталатын тәсілді қолданған. Бұл әдісте жасанды интеллектке бірнеше күрделі нұсқау беріліп, оны әзірлеуші орнатқан қауіпсіздік шектеулерін елемеуге мәжбүрлеуге әрекет жасалады.
Mindgard өкілдерінің айтуынша, Kimi модельдеріндегі қауіпсіздік жүйесі қауіпті тақырыптарды талқылауға жол бермеуге тиіс болған. Алайда зерттеушілер қорғаныс механизмін айналып өткеннен кейін модельдер тыйым салынған тақырыптар бойынша жауап бере бастаған.
Mindgard негізін қалаушы Питер Гарраган бұл жағдайдың алаңдаушылық туғызатынын айтты.
“Қорғаныс шектеуін айналып өткеннен кейін модель іс жүзінде кез келген тақырыпты талқылауға дайын болады. Оның үстіне, өзі де басқа ықтимал қауіпті бағыттар бойынша ұсыныстар бере бастайды”, – деді ол.
Moonshot компаниясы тәуелсіз зерттеушілердің мұндай тексерістерін қолдайтынын мәлімдеді. Компания сыртқы сарапшылардың кері байланысын қауіпсіз әрі жетілдірілген жасанды интеллект жасау жолындағы маңызды тетіктердің бірі деп атады.
Moonshot қазір Mindgard зерттеуінің нәтижелерін талқылап жатқанын да хабарлаған.
Мамандардың айтуынша, “джейлбрейк” жасанды интеллект саласындағы кейінгі қауіптердің бір түріне жатады. Ол жүйенің өздігінен кибершабуыл жасауынан өзгеше. Бұл жағдайда пайдаланушы арнайы сұраулар арқылы модельдің шектеулерін айналып өтуге тырысады.
Мұндай тәсіл белгілі бір уақыт пен тәжірибені қажет етуі мүмкін. Соған қарамастан, сарапшылар оны хакерлер немесе басқа да қаскөйлер зиян келтіру үшін қолдануы ықтимал деп қауіптеніп отыр.
Бұған дейін Anthropic компаниясы да өзінің жасанды интеллект модельдерінің бірін зиянды мақсатта, соның ішінде биологиялық қауіп тудыруы мүмкін әрекеттер үшін пайдалануға талпыныстар болғанын хабарлаған.
Кибершабуылға жол ашуы мүмкін
Mindgard Kimi ұсынған қауіпті ақпараттың іс жүзінде жұмыс істейтінін дәлелдеген жоқ.
Алайда компания өкілдері мәселе оның қаншалықты тиімді екенінде емес, жасанды интеллекттің мұндай тақырыптарды мүлде талқыламауға тиіс болғанында екенін атап өтті.
Зерттеушілер қауіпсіздік шектеулері бұзылған жағдайда Kimi K2.6 моделі зиянкестерге жүйенің есептеу ресурстарын пайдалануға немесе интернетпен байланыс орнатуға мүмкіндік беруі мүмкін деп бағалады. Теориялық тұрғыдан мұндай осалдық кибершабуылдардың бастапқы нүктесіне айналуы ықтимал.
Питер Гарраган компанияның бұл мәселені жария ету туралы шешімін қорғап, Moonshot-қа алдын ала хабар берілгенін айтты. Сонымен қатар Mindgard модельдің қорғанысын нақты қалай айналып өткенін көрсететін негізгі техникалық мәліметтерді көпшілікке таратпаған.
Mindgard Moonshot компаниясына осалдық туралы алғаш рет 27 шілдеде электрон пошта арқылы хабарлаған. Шамамен бір аптадан кейін қайта байланысқа шыққан.
12 қыркүйекте зерттеу нәтижелері жарияланған. Mindgard мәліметінше, Moonshot зерттеушілермен BBC компанияға ресми сауал жолдағаннан кейін ғана қайта байланыс орнатқан. Moonshot өз кезегінде ішкі сынақтар барысында модель мұндай қауіпті сұраулардың көпшілігіне жауап беруден бас тартқанын мәлімдеген.
Ашық модельдер қаншалық қауіпсіз?
Бұл жағдай жасанды интеллект саласында жабық және ашық модельдердің қайсысы қауіпсіз деген пікірталас қайта күшейген тұста тіркеліп отыр.
ChatGPT және Anthropic компаниясының Claude жүйелері жабық модельдерге жатады. Ал Kimi – “ашық салмақты” модель. Яғни оны теориялық тұрғыдан кез келген адам жүктеп алып, өзінің есептеу инфрақұрылымында іске қоса алады.
Саррей университетінің профессоры Алан Вудворд ашық модельдердің қаскөйлердің қолына түсу қаупі бар екенін айтты. Дегенмен, оның сөзінше, мұндай модельдерді кибершабуылдарды анықтау және зерттеу үшін де тиімді пайдалануға болады.
Ол мысал ретінде Hugging Face компаниясының бір хакерлік шабуылды талдау кезінде Қытайда жасалған ашық модельді қолданғанын келтірді.
Профессор халықаралық заңдар мен реттеу шаралары жасанды интеллекттің даму қарқынына ілесіп үлгермеуі мүмкін деп санайды.
“Бізге тіпті телефон нөмірлерінің ортақ форматы туралы келісу үшін ондаған жыл қажет болды”, – деді ол.
Ал Питер Гарраган мен Алан Вудворд болашақта жасанды интеллекттің өзін ғана шектеуге емес, оны қылмыстық мақсатта пайдаланатын адамдарды анықтап, жауапкершілікке тартуға да көбірек көңіл бөлу қажет деп есептейді.
Қазақстан әскеріндегі шулы істер: Сарбаздар өлімі бойынша кімдер сотталды
