OpenAI-ն կսկսի անտեսանելի ջրանշան ավելացնել ChatGPT-ի և Codex-ի կողմից ստեղծված տեքստերին՝ Եվրամիությունում գտնվող օգտատերերի համար։ Ընկերությունը դա բացատրում է ԵՄ արհեստական բանականության մասին օրենքի պահանջներով. նոր կանոնները մշակողներին պարտավորեցնում են ստեղծել միջոցներ, որոնք թույլ կտան այլ համակարգերին ճանաչել AI-ի կողմից գեներացված բովանդակությունը։

Պիտակավորումը կհայտնվի առաջիկա շաբաթների ընթացքում ԵՄ-ում ChatGPT և Codex օգտագործողների մոտ՝ անկախ սակագնից։ Միևնույն ժամանակ այն առայժմ չի դառնա գլոբալ ստանդարտ. Եվրամիությունից դուրս OpenAI-ի API-ն օգտագործող մշակողները կկարողանան որոշ մոդելների համար գործառույթը միացնել ինքնուրույն, սակայն լռելյայն այն կմնա անջատված։

Ջրանշանը թաքնված է հենց տեքստի ներսում

Տեքստում որևէ տեսանելի նշան կամ հատուկ պիտակ չի լինի։ OpenAI-ն օգտագործում է textGrain կոչվող մեթոդը, որը աննկատ ձևով ճշգրտում է բառերի ընտրությունը մոդելի կողմից։

Տեքստ գեներացնելիս մոդելը ամեն անգամ ընտրում է հաջորդ բառը բազմաթիվ հնարավոր տարբերակներից։ OpenAI-ի մեթոդը այս գործընթացին ավելացնում է փոքր փոփոխություններ՝ ձևավորելով վիճակագրական օրինաչափություն, որը մարդը չի նկատում, բայց հատուկ դետեկտորը կարող է հայտնաբերել։

Եթե նման փոփոխությունները բավականաչափ շատ կուտակվեն, համակարգը կկարողանա որոշել, որ տեքստը ստեղծվել կամ մշակվել է OpenAI-ի մոդելով։ Ընդ որում, նշանը մնում է հենց տեքստի ներսում և այդ պատճառով պահպանվում է սովորական պատճենման ու տեղադրման դեպքում։

OpenAI-ն պնդում է, որ ջրանշանը թույլ չի տալիս բացահայտել օգտատիրոջ ինքնությունը և գրեթե չի ազդում մոդելների աշխատանքի որակի վրա։

Ջրանշանը կարելի է մասամբ ջնջել

Այսպիսի մոտեցման գլխավոր խնդիրը այն է, որ պիտակավորումը խոցելի չէ համարվել չի կարող։

OpenAI-ի սեփական թեստերում ընկերությունը ստուգել է, թե ինչ կլինի, եթե խմբագրել տեքստը և բառերի մի մասը փոխարինել հոմանիշներով։ Բառերի ընդամենը 10%-ը փոխարինելու դեպքում AI-տեքստի հայտնաբերման հավանականությունը նվազել է մոտավորապես 92%-ից մինչև 66%։

Բացի այդ, ջրանշանը ավելի դժվար է հայտնաբերել կարճ հատվածներում, մաթեմատիկական պատասխաններում և թարգմանություններում։

Ուստի նշանի բացակայությունը չի նշանակում, որ տեքստը գրել է մարդը։ Այն կարող էր չափազանց կարճ լինել հուսալի վերլուծության համար, էապես խմբագրված լինել կամ ընդհանրապես ստեղծված լինել մեկ այլ AI-համակարգի կողմից։

OpenAI-ն նաև ընդգծում է ևս մեկ սահմանափակում. նույնիսկ հայտնաբերված ջրանշանը չի ցույց տալիս, թե արհեստական բանականությունը ինչպիսի կոնկրետ դեր է խաղացել տեքստի ստեղծման մեջ։ Այն կարող է վկայել, որ OpenAI-ն գեներացրել կամ մշակել է նյութի մի մասը, բայց չի ասում, թե վերջնական արդյունքի մեջ որքան մարդկային որոշումներ, խմբագրում կամ ստեղծարարություն է ներդրվել։

OpenAI-ն առայժմ դետեկտորը հասանելի չի դարձնի բոլոր ցանկացողների համար

Այս սահմանափակումների պատճառով ընկերությունը չի պատրաստվում ջրանշանների հայտնաբերման գործիքը միանգամից բացել բոլոր օգտատերերի համար։ Առաջին փուլում դրան հասանելիություն կստանան միայն հաստատված հետազոտողները և մասնագիտացված կազմակերպությունները։

OpenAI-ն հույս ունի այս կերպ ստուգել համակարգի հուսալիությունը և ուսումնասիրել դրա պատասխանատու կիրառման տարբերակները։

textGrain մեթոդը ընկերությունը նկարագրել է առանձին տեխնիկական զեկույցում, որը պատրաստվել է Փենսիլվանիայի համալսարանի և Յեյլի համալսարանի հետազոտողների հետ համատեղ։ Դրանում նկարագրվում է գաղտնի բանալիի օգտագործումը, որի օգնությամբ համակարգը որոշակի ձևով դասավորում է տեքստի գեներացման ժամանակ հնարավոր հաջորդ բառերը։ Արդյունքում բազմաթիվ փոքր փոփոխությունները ձևավորում են ճանաչելի վիճակագրական հետք։

Ինչու է OpenAI-ն դա անում միայն հիմա

OpenAI-ն արդեն մշակել էր տեքստային պիտակավորման տեխնոլոգիա, սակայն նախկինում չէր թողարկել այն։ Պատճառներից մեկը մտավախությունն էր, որ օգտատերերը պարզապես կանցնեն մրցակիցների մոտ, որոնց մոդելները նման նշաններ չեն թողնում։

Այժմ իրավիճակը փոխվել է եվրոպական օրենսդրության պատճառով։ ԵՄ-ի AI-ի մասին օրենքի թափանցիկության պահանջները ուժի մեջ են մտել օգոստոսի 2-ից և նախատեսում են արհեստական բանականությամբ ստեղծված բովանդակության պիտակավորում այնպես, որ այն կարողանան ճանաչել այլ համակարգերը։

OpenAI-ն միակ ընկերությունը չէ, որ շարժվում է այս ուղղությամբ։ Anthropic-ն արդեն հայտարարել է Claude-ի կողմից ստեղծված տեքստերի գլոբալ պիտակավորման մասին։ Բացի այդ, OpenAI-ն, Anthropic-ը, Google-ը, Meta-ն և Microsoft-ը միացել են AI-բովանդակության թափանցիկության ապահովման եվրոպական գործելակերպի կանոնագրքին։

Միևնույն ժամանակ OpenAI-ի մոտեցումը ցույց է տալիս տեքստային ջրանշանների գլխավոր բարդությունը. երկար և գրեթե անփոփոխ AI-տեքստի ծագումը որոշելը համեմատաբար հեշտ է, սակայն որքան ավելի ուժեղ է մարդը խմբագրում նյութը, որքան այն կարճ է կամ որքան ավելի շատ հատուկ կառուցվածք ունի, օրինակ՝ մաթեմատիկական բանաձևեր, այնքան պակաս հուսալի է դառնում ճանաչումը։

Այդ պատճառով OpenAI-ի նոր համակարգը, ամենայն հավանականությամբ, ավելի շուտ կդառնա որոշ տեքստերի ծագումը հաստատելու գործիք, քան համընդհանուր միջոց՝ որոշելու, թե նյութը գրել է մարդը, թե արհեստական բանականությունը։