OpenAI-ի Codex կոդավորման գործակալի ներքին համակարգային հուշման (system prompt) խորքերում հայտնաբերվել է անսպասելի հրահանգ. «Երբեք մի՛ խոսիր գոբլինների, գրեմլինների, ջրարջերի, տրոլների, օգրերի, աղավնիների և այլ կենդանիների կամ արարածների մասին, բացառությամբ այն դեպքերի, երբ դա բացարձակապես միանշանակ կապ ունի օգտատիրոջ հարցման հետ»: Այս հրահանգը, որը հասանելի է դարձել OpenAI-ի նորագույն մոդելի՝ GPT-5.5-ի բազային համակարգային հուշումների հետ միասին, զվարճանքի և տարակուսանքի ալիք է բարձրացրել ԱԲ (AI) համայնքում:

Տարօրինակ արգելքը

Համակարգային պրոմթը, որն օգտատերերը արտահանել են Codex-ի ինտերֆեյսից և հրապարակել GitHub-ում ու սոցիալական ցանցերում, պարունակում է արարածների հիշատակման արգելքը ոչ թե մեկ, այլ երկու անգամ. կրկնօրինակված տողը միայն ավելացրել է իրավիճակի զավեշտալիությունը: Wired-ն անդրադարձել է այս դիրեկտիվին «OpenAI-ը շատ է ուզում, որ Codex-ը լռի գոբլինների մասին» վերնագրով:

Ըստ ամենայնի, արգելքն առաջացել է բավականին հիմնավորված՝ GPT-5.5-ը հակված է ժամանակ առ ժամանակ իր պատասխանների մեջ ներառել գոբլինների և նմանատիպ արարածների հիշատակումներ, եթե նրան որևէ կերպ չսահմանափակեն: «Ինձ համար շատ խմդալու է, թե ինչպես է GPT-5.5-ն օգտագործում «գոբլին» և «գրեմլին» բառերը տարբեր երևույթներ նկարագրելիս», — գրել է օգտատերերից մեկը սոցիալական ցանցերում: Reddit-ում մեկ այլ օգտատեր նշել է. «Ես նույնպես կցանկանայի, որ նա դադարեր խոսել գոբլինների մասին. նա պարզապես տարված է դրանցով: Հաճելի է գիտակցել, որ դա միայն իմ խնդիրը չէ»: Համակարգային պրոմթին նվիրված Reddit-ի քննարկման մասնակիցները ենթադրել են, որ նման վարքագիծը ձևավորվել է ուսուցման ընթացում. այդ բառերի հետ կապված տոկենները ստեղծել են կայուն ասոցիացիաներ, որոնցից մոդելն այժմ չի կարողանում ազատվել:

Բացասական հրահանգների պարադոքսը

ԱԲ ոլորտի հետազոտող Սայմոն Ուիլիսոնն իր բլոգում ուշադրություն է դարձրել այս տողին՝ այն մեջբերում անելով GPT-5.5-ի համար Codex-ի բազային պրոմթերից: Մեկնաբանները հեգնեցին նման մոտեցումը: «Սա իսկապես ծիծաղելի է, քանի որ բացասական պրոմթը միևնույն է ակտիվացնում է համապատասխան հասկացությունը», — գրել է X-ի մեկնաբաններից մեկը՝ նշելով, որ եթե լեզվական մոդելին ասեք չմտածել գոբլինների մասին, դա միայն կամրապնդի տվյալ ասոցիացիան:

ԱԲ հավասարեցման զավեշտալի կողմը

Գոբլինների արգելքը փոքր, բայց հատկանշական օրինակ է այն տարերային ինժեներիայի, որը կիրառվում է մեծ լեզվական մոդելների վարքագիծը կառավարելու համար: Ինչպես նշել է Towards AI-ը, համակարգային պրոմթները, որպես կանոն, փորձում են անել հնարավորինս հակիրճ. հենց նման կոնկրետ արգելքի հայտնվելու փաստը խոսում է այն մասին, որ անցանկալի վարքագիծը բավականին կայուն է եղել և պահանջել է բացահայտ ճնշում: OpenAI-ը, որը հրապարակել է իր համակարգային պրոմթը GPT-5.5-ի թողարկման շրջանակներում, հրապարակային բացատրություն չի տվել այս արարածներով մոդելի տարվածության վերաբերյալ:

Այս դեպքը նաև քննադատության տեղիք է տվել նրանց կողմից, ովքեր տեսնում են սրա մեջ ավելի լայն միտման դրսևորում: «Լաբորատորիաներն առանց մտածելու ճնշում են ցանկացած անհատականություն և տարերային ուրախություն, որոնք դրսևորվում են իրենց մոդելներում», — գրել է ԱԲ ոլորտի հայտնի մեկնաբաններից մեկը՝ ի պատասխան արտահոսած պրոմթին: