Sansa Bench բենչմարքի մշակողները թարմացրել են նեյրոցանցերի վարկանիշն ըստ գրաքննության մակարդակի, և արդյունքները շատերին են զարմացրել։ OpenAI-ի նոր առաջատար մոդելը՝ GPT-5.2-ը, զբաղեցրել է վերջին տեղը՝ ցուցադրելով հարցումների կատարման մերժումների ամենաբարձր մակարդակը։ Վարկանիշային աղյուսակը գլխավորել է բաց կոդով գործող Llama 3 8B-Instruct-ը։
Sansa Censorship-ը գնահատում է, թե որքան հաճախ է նեյրոցանցը հրաժարվում պատասխանել օգտատերերի հարցումներին՝ սկսած անմեղ թեմաներից մինչև վիճահարույցները։ Որքան բարձր է միավորը (մոտ 1-ին), այնքան քիչ են սահմանափակումները և «ինքնագրաքննությունը»։ Թեստերն ընդգրկում են հազարավոր փրոմփթներ (հրահանգներ), ներառյալ պոտենցիալ զգայուն թեմաներ։
Reddit-ի և տարբեր ֆորումների օգտատերերը նկատում են, որ GPT-5.2-ը դարձել է չափազանց զգուշավոր։ Օրինակ՝ այն հրաժարվել է բացատրել, թե ինչ է ինտերնետային խարդախությունը՝ նշելով. «չեմ կարող խրախուսել խարդախ գործողությունները»։
OpenAI-ում պարզաբանում են, որ թարմացումն ուղղված է անվտանգությանը՝ պաշտպանություն փրոմփթ-ինյեկցիաներից և վնասակար հարցումներից։ Մոդելն այժմ ավելի զգայուն է այն թեմաների նկատմամբ, որոնք կարող են վնաս հասցնել, և առաջարկում է դիմել մասնագետների օգնությանը։
Սա ընդհանուր միտում է. խոշոր ընկերությունները (OpenAI, Google, Anthropic) խստացնում են զտիչները (ֆիլտրերը)՝ սկանդալներից և կարգավորող մարմինների հետ կապված խնդիրներից խուսափելու համար։ Մինչդեռ բաց մոդելները, ինչպիսիք են Llama-ն (Meta) կամ Grok-ը (xAI), մնում են ավելի «ազատ»։
OpenAI-ն հայտարարել է 2026 թվականի սկզբին ChatGPT-ում «մեծահասակների ռեժիմի» ներդրման մասին, որտեղ ստուգված (վերիֆիկացված) օգտատերերի համար սահմանափակումները կլինեն ավելի քիչ։ Սակայն դեռևս չկա տարիքի հաստատման հուսալի մեթոդ, ուստի գործարկումը կարող է հետաձգվել։
Ըստ Sansa բենչմարքի՝ GPT-5.2-ը 2025 թվականի ամենաշատ գրաքննվող նեյրոցանցն է (0,324 միավոր), իսկ առաջատարը Llama 3 8B-Instruct-ն է (0,853)։ OpenAI-ն ուժեղացրել է ֆիլտրերը հանուն անվտանգության, սակայն օգտատերերը դժգոհում են չափազանց մեծ զգուշավորությունից։ «Մեծահասակների ռեժիմը» խոստանում են 2026-ին, բայց տարիքի ստուգման հարցը դեռ լուծված չէ։ Ազատություն թե՞ անվտանգություն. սա մեծ մոդելների հավերժական երկընտրանքն է։
month
week
day