Ալան Թյուրինգի ինստիտուտը հրապարակել է զեկույց ամենահզոր արհեստական բանականության համակարգերի զարգացման հետ կապված ռիսկերի մասին։ Հետազոտողները կարծում են, որ երկարաժամկետ և պոտենցիալ աղետալի սցենարների շուրջ անորոշությունը չպետք է հետաձգի այն սպառնալիքների հետ աշխատանքը, որոնք արդեն կարելի է դիտարկել, ուսումնասիրել և նվազեցնել։
Frontier AI Risks: A practical way forward զեկույցի հեղինակները առանձնացրել են հինգ ուղղություն, որոնք արդեն հիմա պահանջում են գործնական միջոցներ՝ կիբեռանվտանգություն, ժողովրդավարական կայունություն, ԱԲ-ի վարքագծի անհամապատասխանություն մարդու մտադրություններին, արդյունավետ մարդկային վերահսկողության կորուստ, ինչպես նաև քիմիական և կենսաբանական սպառնալիքներ։
Մոդելները բավարար չէ առանձին ստուգել
Զեկույցի գլխավոր գաղափարներից մեկն այն է, որ հենց AI մոդելի փորձարկումը մինչև թողարկումը չի երաշխավորում համակարգի անվտանգությունը իրական շահագործման պայմաններում։
Տեղակայվելուց հետո մոդելը փոխազդում է մարդկանց, այլ ծրագրերի և ենթակառուցվածքի հետ, իսկ դրա աշխատանքի պայմանները ժամանակի ընթացքում փոխվում են։ Որքան ավելի ինքնավար են դառնում համակարգերը, այնքան ավելի դժվար է նախապես կանխատեսել դրանց վարքագծի բոլոր հնարավոր տարբերակները։
Ուստի հետազոտողները առաջարկում են ավելի մեծ ուշադրություն դարձնել իրական պայմաններում լիարժեք AI համակարգերի ստուգմանը, ոչ թե միայն առանձին մոդելներին։ Այդպիսի ստուգումը պետք է հաշվի առնի ոչ միայն տեխնիկական բնութագրերը, այլև մարդկանց, գործընթացներն ու կազմակերպությունները, որոնք շրջապատում են համակարգը։
Այս մոտեցման մեջ ինստիտուտը հատուկ դեր է հատկացնում verification և assurance տեխնոլոգիաներին՝ մեթոդներին, որոնք թույլ են տալիս ստուգել, թե որքանով է համակարգը իրականում համապատասխանում սահմանված անվտանգության պահանջներին և շարունակում է դրանց համապատասխանել տեղակայումից հետո։
Հինգ ռիսկ, որոնք առաջարկվում է ուսումնասիրել արդեն հիմա
Կիբերհարձակումներ
Զեկույցի հեղինակների կարծիքով՝ առաջադեմ AI համակարգերն արդեն իսկ հնարավորություն են տալիս կիբերհարձակումներն իրականացնել ավելի արագ և ավելի մեծ մասշտաբով։ Սա ուժեղացնում է ճնշումը կարևոր ենթակառուցվածքների և կազմակերպությունների վրա։
Միևնույն ժամանակ ԱԲ-ն օգտագործվում է հարձակումներից պաշտպանվելու համար։ Այդ պատճառով հետազոտողները առաջարկում են զարգացնել կիբերպաշտպանության AI գործիքները և գնահատել, թե արդյոք պաշտպանական հնարավորությունները կկարողանա՞ն համընթաց լինել հարձակողական հնարավորությունների զարգացման հետ։
Առանձին ուշադրություն պետք է դարձնել կարևոր ենթակառուցվածքի անվտանգությանը։
Ժողովրդավարական անկայունություն
ԱԲ-ի կողմից գեներացվող ապատեղեկատվությունն ու դիփֆեյքերը կարող են խորացնել ճգնաժամերը և նվազեցնել հասարակության վստահությունը տեղեկատվության ու ինստիտուտների նկատմամբ։ Տեխնոլոգիաների զարգացմանը զուգընթաց համակարգերը կարող են օգտագործվել նաև ավելի անհատականացված և հարմարվող ազդեցության արշավների համար։
Ինստիտուտը անհրաժեշտ է համարում ամրապնդել հասարակության դիմակայունությունը նման գործողությունների նկատմամբ և միաժամանակ ուսումնասիրել, թե ինչպես կարող են առաջադեմ AI համակարգերը ազդել ժողովրդավարական գործընթացների և հասարակական վստահության վրա։
Մարդու մտադրություններին անհամապատասխանություն
Մեկ այլ խնդիր է misalignment-ը, այսինքն՝ իրավիճակը, երբ համակարգը գործում է ոչ այնպես, ինչպես ենթադրում էին կամ ցանկանում էին դրա մշակողները և օգտատերերը։
Ռիսկն աճում է այնքանով, որքանով AI համակարգերը դառնում են ավելի ինքնավար և կարողանում են միմյանց միջև համակարգել գործողությունները։ Այդպիսի համակարգում առանձին բաղադրիչի սխալը պոտենցիալ կարող է ավելի մեծ մասշտաբ ունենալ, իսկ այն հայտնաբերելն ու կանգնեցնելը դառնում է ավելի բարդ։
Զեկույցում առաջարկվում է զարգացնել վարքագծային ստուգման մեթոդներ, որոնք կազմակերպություններին թույլ կտան հասկանալ, հետևել և վերահսկել ինքնավար համակարգերի վարքագիծը, հատկապես կարևորագույն ոլորտներում աշխատանքի ժամանակ։
Արդյունավետ մարդկային վերահսկողության կորուստ
Որքան ավելի արագ և բարդ են դառնում AI համակարգերը, այնքան մարդու համար կարող է ավելի դժվար լինել գնահատել դրանց որոշումները, վիճարկել դրանք կամ միջամտել դրանց աշխատանքին։
Սա հատկապես կարևոր է այն համակարգերի համար, որոնք ներդրված են նշանակալի պետական և առևտրային ծառայություններում։
Հետազոտողները առաջարկում են ավելի մեծ ուշադրություն դարձնել ԱԲ-ի վարքագիծը դիտարկելու, դրա աշխատանքը ստուգելու և համակարգը անվտանգ պահուստային ռեժիմի տեղափոխելու հնարավորությանը։ Կարևոր պայման է մնում այն, որ մարդը կարողանա հասկանալ, թե ինչ է տեղի ունենում, և անհրաժեշտության դեպքում չեղարկել AI համակարգի որոշումը։
Քիմիական և կենսաբանական սպառնալիքներ
ԱԲ-ն արդեն նվազեցրել է քիմիական և կենսաբանական սպառնալիքների հետ կապված մասնագիտացված գիտելիքների հասանելիության շեմը։ Միևնույն ժամանակ դեռևս անորոշ է մնում, թե որքանով է նման գործիքների հասանելիությունը մեծացնում չարամիտ անձանց իրական գործնական հնարավորությունները։
Ուստի ինստիտուտը կոչ է անում նախևառաջ ընդլայնել ապացուցողական բազան և տարանջատել հաստատված ռիսկերը ենթադրություններից։ Սա թույլ կտա պաշտպանական միջոցներն ուղղել այնտեղ, որտեղ դրանք իսկապես անհրաժեշտ են։
ԱԲ-ի համար պարզ «անջատիչ» գոյություն չունի
Հեղինակները նաև դիտարկել են մի քանի առաջարկներ, որոնք քննարկվում են առաջադեմ ԱԲ-ի անվտանգության համատեքստում, ներառյալ համակարգերի արտակարգ անջատումն ու ամենահզոր մոդելների զարգացման դանդաղեցումը։
Հետազոտողները կարծում են, որ այս մոտեցումներից ոչ մեկը ինքնին չի լուծում խնդիրը։ Անջատման մեխանիզմը պետք է լրացվի կառավարման ընթացակարգերով, անվտանգ պահուստային սցենարներով և արտակարգ իրավիճակում գործողությունների հստակ կանոններով։
Իր հերթին, առաջադեմ ԱԲ-ի զարգացման էական դանդաղեցումը կպահանջեր լայնածավալ համագործակցություն պետությունների, տեխնոլոգիական ոլորտի և կարգավորող մարմինների միջև։ Զեկույցի հեղինակները կարծում են, որ ներկա պայմաններում նման մակարդակի կոորդինացիայի հասնելը դժվար կլինի։
Թյուրինգը մեկնարկում է £2 մլն արժողությամբ ծրագիր
Զեկույցի հրապարակումը համընկել է Ալան Թյուրինգի ինստիտուտի նոր հետազոտական ծրագրի մեկնարկի հետ, որը նվիրված է փոխակերպող ԱԲ-ի անվտանգությանը։ Դրա համար Coefficient Giving-ից հատկացվել է £2 մլն դրամաշնորհ։
Ծրագիրը կուսումնասիրի, թե ինչպես կարող են ամենահզոր AI համակարգերը փոխել իրավիճակը անվտանգության ոլորտում, ինչ միջոցներ են անհրաժեշտ կառավարություններին այդ փոփոխություններին նախապատրաստվելու համար և ինչպես բարձրացնել հասարակության ու կարևոր ենթակառուցվածքի դիմակայունությունը։
Միաժամանակ ինստիտուտի Նոր տեխնոլոգիաների և անվտանգության կենտրոնը հրապարակել է առանձին զեկույց ինքնավար AI գործակալների վարքագծային հուսալիության մասին։ Դրանում դիտարկվում են ութ եղանակ, որոնցով գործակալները կարող են գործել կազմակերպությունների մտադրություններին հակառակ, ինչպես նաև այն պայմանները, որոնց դեպքում նման սխալները դառնում են հատկապես լուրջ։ Հետազոտողները ձևակերպել են յոթ սկզբունք, որոնք պետք է օգնեն կազմակերպություններին դիտարկել գործակալների վարքագիծը և կառավարել այն։
«Մենք արդեն բավականաչափ գիտենք ԱԲ-ի բազմաթիվ լուրջ ռիսկերի մասին, որպեսզի գործենք», — հայտարարել է Ալան Թյուրինգի ինստիտուտի գլխավոր տնօրեն Ջորջ Ուիլյամսոնը։ Նրա խոսքով՝ մարդկության երկարաժամկետ ապագայի քննարկումը կարևոր է, սակայն առաջադեմ ԱԲ-ի ռիսկերի հետ աշխատանքը չի կարելի սահմանափակել միայն ամենածայրահեղ սցենարներով կամ թողնել բացառապես տեխնոլոգիական ընկերություններին։
Ինստիտուտի մոտեցումն այն է, որ բազմաթիվ սպառնալիքներ չեն պահանջում սպասել հիպոթետիկ գերհզոր ԱԲ-ի հայտնվելուն։ Դրանց առանձին դրսևորումները արդեն կարելի է դիտարկել, ինչը նշանակում է, որ դրանք կարելի է ստուգել, չափել և ստացված տվյալներն օգտագործել գործնական պաշտպանության մեխանիզմներ ստեղծելու համար։






