OpenAI-ն կսկսի անտեսանելի ջրանշան ավելացնել ChatGPT-ի և Codex-ի կողմից ստեղծված տեքստերին՝ Եվրամիությունում գտնվող օգտատերերի համար։ Ընկերությունը դա բացատրում է ԵՄ արհեստական բանականության մասին օրենքի պահանջներով. նոր կանոնները մշակողներին պարտավորեցնում են ստեղծել միջոցներ, որոնք թույլ կտան այլ համակարգերին ճանաչել AI-ի կողմից գեներացված բովանդակությունը։
Պիտակավորումը կհայտնվի առաջիկա շաբաթների ընթացքում ԵՄ-ում ChatGPT և Codex օգտագործողների մոտ՝ անկախ սակագնից։ Միևնույն ժամանակ այն առայժմ չի դառնա գլոբալ ստանդարտ. Եվրամիությունից դուրս OpenAI-ի API-ն օգտագործող մշակողները կկարողանան որոշ մոդելների համար գործառույթը միացնել ինքնուրույն, սակայն լռելյայն այն կմնա անջատված։
Ջրանշանը թաքնված է հենց տեքստի ներսում
Տեքստում որևէ տեսանելի նշան կամ հատուկ պիտակ չի լինի։ OpenAI-ն օգտագործում է textGrain կոչվող մեթոդը, որը աննկատ ձևով ճշգրտում է բառերի ընտրությունը մոդելի կողմից։
Տեքստ գեներացնելիս մոդելը ամեն անգամ ընտրում է հաջորդ բառը բազմաթիվ հնարավոր տարբերակներից։ OpenAI-ի մեթոդը այս գործընթացին ավելացնում է փոքր փոփոխություններ՝ ձևավորելով վիճակագրական օրինաչափություն, որը մարդը չի նկատում, բայց հատուկ դետեկտորը կարող է հայտնաբերել։
Եթե նման փոփոխությունները բավականաչափ շատ կուտակվեն, համակարգը կկարողանա որոշել, որ տեքստը ստեղծվել կամ մշակվել է OpenAI-ի մոդելով։ Ընդ որում, նշանը մնում է հենց տեքստի ներսում և այդ պատճառով պահպանվում է սովորական պատճենման ու տեղադրման դեպքում։
OpenAI-ն պնդում է, որ ջրանշանը թույլ չի տալիս բացահայտել օգտատիրոջ ինքնությունը և գրեթե չի ազդում մոդելների աշխատանքի որակի վրա։
Ջրանշանը կարելի է մասամբ ջնջել
Այսպիսի մոտեցման գլխավոր խնդիրը այն է, որ պիտակավորումը խոցելի չէ համարվել չի կարող։
OpenAI-ի սեփական թեստերում ընկերությունը ստուգել է, թե ինչ կլինի, եթե խմբագրել տեքստը և բառերի մի մասը փոխարինել հոմանիշներով։ Բառերի ընդամենը 10%-ը փոխարինելու դեպքում AI-տեքստի հայտնաբերման հավանականությունը նվազել է մոտավորապես 92%-ից մինչև 66%։
Բացի այդ, ջրանշանը ավելի դժվար է հայտնաբերել կարճ հատվածներում, մաթեմատիկական պատասխաններում և թարգմանություններում։
Ուստի նշանի բացակայությունը չի նշանակում, որ տեքստը գրել է մարդը։ Այն կարող էր չափազանց կարճ լինել հուսալի վերլուծության համար, էապես խմբագրված լինել կամ ընդհանրապես ստեղծված լինել մեկ այլ AI-համակարգի կողմից։
OpenAI-ն նաև ընդգծում է ևս մեկ սահմանափակում. նույնիսկ հայտնաբերված ջրանշանը չի ցույց տալիս, թե արհեստական բանականությունը ինչպիսի կոնկրետ դեր է խաղացել տեքստի ստեղծման մեջ։ Այն կարող է վկայել, որ OpenAI-ն գեներացրել կամ մշակել է նյութի մի մասը, բայց չի ասում, թե վերջնական արդյունքի մեջ որքան մարդկային որոշումներ, խմբագրում կամ ստեղծարարություն է ներդրվել։
OpenAI-ն առայժմ դետեկտորը հասանելի չի դարձնի բոլոր ցանկացողների համար
Այս սահմանափակումների պատճառով ընկերությունը չի պատրաստվում ջրանշանների հայտնաբերման գործիքը միանգամից բացել բոլոր օգտատերերի համար։ Առաջին փուլում դրան հասանելիություն կստանան միայն հաստատված հետազոտողները և մասնագիտացված կազմակերպությունները։
OpenAI-ն հույս ունի այս կերպ ստուգել համակարգի հուսալիությունը և ուսումնասիրել դրա պատասխանատու կիրառման տարբերակները։
textGrain մեթոդը ընկերությունը նկարագրել է առանձին տեխնիկական զեկույցում, որը պատրաստվել է Փենսիլվանիայի համալսարանի և Յեյլի համալսարանի հետազոտողների հետ համատեղ։ Դրանում նկարագրվում է գաղտնի բանալիի օգտագործումը, որի օգնությամբ համակարգը որոշակի ձևով դասավորում է տեքստի գեներացման ժամանակ հնարավոր հաջորդ բառերը։ Արդյունքում բազմաթիվ փոքր փոփոխությունները ձևավորում են ճանաչելի վիճակագրական հետք։
Ինչու է OpenAI-ն դա անում միայն հիմա
OpenAI-ն արդեն մշակել էր տեքստային պիտակավորման տեխնոլոգիա, սակայն նախկինում չէր թողարկել այն։ Պատճառներից մեկը մտավախությունն էր, որ օգտատերերը պարզապես կանցնեն մրցակիցների մոտ, որոնց մոդելները նման նշաններ չեն թողնում։
Այժմ իրավիճակը փոխվել է եվրոպական օրենսդրության պատճառով։ ԵՄ-ի AI-ի մասին օրենքի թափանցիկության պահանջները ուժի մեջ են մտել օգոստոսի 2-ից և նախատեսում են արհեստական բանականությամբ ստեղծված բովանդակության պիտակավորում այնպես, որ այն կարողանան ճանաչել այլ համակարգերը։
OpenAI-ն միակ ընկերությունը չէ, որ շարժվում է այս ուղղությամբ։ Anthropic-ն արդեն հայտարարել է Claude-ի կողմից ստեղծված տեքստերի գլոբալ պիտակավորման մասին։ Բացի այդ, OpenAI-ն, Anthropic-ը, Google-ը, Meta-ն և Microsoft-ը միացել են AI-բովանդակության թափանցիկության ապահովման եվրոպական գործելակերպի կանոնագրքին։
Միևնույն ժամանակ OpenAI-ի մոտեցումը ցույց է տալիս տեքստային ջրանշանների գլխավոր բարդությունը. երկար և գրեթե անփոփոխ AI-տեքստի ծագումը որոշելը համեմատաբար հեշտ է, սակայն որքան ավելի ուժեղ է մարդը խմբագրում նյութը, որքան այն կարճ է կամ որքան ավելի շատ հատուկ կառուցվածք ունի, օրինակ՝ մաթեմատիկական բանաձևեր, այնքան պակաս հուսալի է դառնում ճանաչումը։
Այդ պատճառով OpenAI-ի նոր համակարգը, ամենայն հավանականությամբ, ավելի շուտ կդառնա որոշ տեքստերի ծագումը հաստատելու գործիք, քան համընդհանուր միջոց՝ որոշելու, թե նյութը գրել է մարդը, թե արհեստական բանականությունը։






