18:40 21 հուլիսի, 2025OpenAI-ը զգալի քայլ է կատարել արհեստական բանականության զարգացման գործում. նրանց փորձարարական լեզվական մոդելը 2025 թվականի Միջազգային մաթեմատիկական օլիմպիադայում (IMO) հասել է ոսկե մեդալի մակարդակի: Այս մասին հայտնել է ընկերության հետազոտող Ալեքսանդր Վեյը, ով աշխատում է լեզվական մոդելների և տրամաբանական եզրակացությունների վրա: Մոդելը լուծել է վեց ամենաբարդ խնդիրներից հինգը՝ վաստակելով 42-ից 35 միավոր, ինչը համապատասխանում է աշխարհի ամենահեղինակավոր մաթեմատիկական մրցույթի լավագույն մասնակիցների արդյունքներին: Այս ձեռքբերումը ընդգծում է ընդհանուր մտածող կարողություններով ԱԲ-ի ստեղծման առաջընթացը, որը կարող է մրցակցել մարդկային բանականության հետ:
Միջազգային մաթեմատիկական օլիմպիադա. մտքի մարտահրավեր
Միջազգային մաթեմատիկական օլիմպիադան (IMO), որը սկսվել է 1959 թվականին Ռումինիայում, համարվում է ավագ դպրոցականների համար ամենաբարդ և հեղինակավոր մրցույթը: Ամեն տարի ավելի քան 100 երկրներ ուղարկում են մինչև վեց մասնակիցներից բաղկացած թիմեր՝ երկու օրվա ընթացքում վեց խնդիր լուծելու համար՝ յուրաքանչյուր նստաշրջանում 4,5 ժամով երեք խնդիր: Խնդիրները ընդգրկում են հանր랑, երկրաչափություն, կոմբինատորիկա և թվերի տեսություն՝ պահանջելով ոչ միայն գիտելիքներ, այլև խորը ոչ ստանդարտ մտածողություն: 2025 թվականին, որն անցկացվել է Ավստրալիայի Սանշայն Քոսթում, 630 մասնակիցներից միայն 67-ը՝ մոտ 10%-ը, ստացել են ոսկե մեդալ:
Ավանդաբար, ԱԲ-ն լավ է հաղթահարում մեծ տվյալների մշակում կամ սովորական հաշվարկներ պահանջող խնդիրները, սակայն IMO-ի խնդիրները յուրահատուկ մարտահրավեր են: Դրանք պահանջում են բազմաթիվ էջերից բաղկացած ապացույցներ, ստեղծագործական մոտեցում և տրամաբանական շղթան երկար ժամանակ պահպանելու կարողություն՝ լավագույն մասնակիցների համար մոտ 100 րոպե մեկ խնդրի համար: Մինչ այժմ նույնիսկ առաջատար մոդելները, ինչպիսիք են Gemini 2.5 Pro-ն կամ Grok-4-ը, չեն կարողացել հասնել նույնիսկ բրոնզե մակարդակի (19 միավոր)՝ MathArena.ai-ի թեստերում վաստակելով առավելագույնը 13 միավոր:
OpenAI-ի բեկումը
Ալեքսանդր Վեյի հայտարարած OpenAI-ի փորձարարական մոդելը կարողացել է հաղթահարել այդ խոչընդոտները: Այն լուծել է IMO 2025-ի խնդիրները նույն պայմաններում, ինչ մարդիկ՝ առանց ինտերնետի, արտաքին գործիքների կամ ծրագրերի հասանելիության՝ հենվելով միայն պաշտոնական խնդրի պայմանների ընթերցման և բնական լեզվով ապացույցների ստեղծման վրա: Մոդելը հաջողությամբ լուծել է P1–P5 խնդիրները՝ վաստակելով 35-ից 42 միավոր, ինչը համապատասխանում է ոսկե մեդալի շեմին: Գնահատումն իրականացրել են IMO-ի երեք նախկին մեդալակիրներ, որոնք միաձայն հաստատել են մոդելի բազմաթիվ էջերից բաղկացած ապացույցների որակը:
Ի տարբերություն մասնագիտացված համակարգերի, ինչպիսին է Google DeepMind-ի AlphaGeometry 2-ը, որը 2024 թվականին հասել է ոսկե մեդալի մակարդակի երկրաչափության մեջ, OpenAI-ի մոդելը համընդհանուր լեզվական մոդել է (LLM), որն օգտագործում է ուսուցման հետևողականությամբ և թեստավորման ժամանակ հաշվողական մասշտաբով նոր մոտեցումներ: Վեյի խոսքով՝ հաջողությունը ձեռք է բերվել ոչ թե նեղ մասնագիտացված մեթոդներով, այլ ընդհանուր մտածողության բեկման շնորհիվ, ինչը այս ձեռքբերումը դարձնում է քայլ դեպի արհեստական ընդհանուր բանականություն (AGI):OpenAI-ի գործադիր տնօրեն Սեմ Ալթմանը ընդգծ
OpenAI-ի գործադիր տնօրեն Սեմ Ալթմանը ընդգծել է. «Սա մասնագիտացված մաթեմատիկական համակարգ չէ, այլ լեզվական մոդել է, որը խնդիրներ է լուծում լավագույն մաթեմատիկոսների մակարդակով: Սա ԱԲ-ի առաջընթացի կարևոր ցուցիչ է վերջին տարիներին»: Վեյը նաև նշել է, որ մոդելը գերազանցել է սպասելիքները. 2021 թվականին նա կանխատեսել էր ընդամենը 30% հաջողություն MATH-ի պակաս բարդ թեստում մինչև 2025 թվականի հուլիսը, սակայն ԱԲ-ն հասել է IMO-ի մակարդակի:
Հակասություններ և հարցեր
OpenAI-ի ձեռքբերումը առաջացրել է ինչպես հիացմունք, այնպես էլ սկեպտիցիզմ: Որոշ փորձագետներ, այդ թվում՝ Նյու Յորքի համալսարանի պրոֆեսոր Գարի Մարկուսը, նշել են, որ արդյունքները դեռևս անկախ կերպով չեն հաստատվել IMO-ի պաշտոնական կազմակերպիչների կողմից: Բացի այդ, Google DeepMind-ի հետազոտող Թանգ Լուոնգը քննադատել է OpenAI-ին մրցանակաբաշխության արարողությունից առաջ արդյունքները հայտարարելու համար, ինչը խախտել է IMO-ի՝ մասնակից մարդկանց ձեռքբերումների վրա ուշադրությունը պահպանելու ուղղված առաջարկությունները: Լուոնգը նաև ենթադրել է, որ մոդելը կարող էր վաստակել արծաթե մեդալին համապատասխան միավորներ, այլ ոչ թե ոսկե, վեցերորդ խնդրի ձախողման պատճառով, թեև այս պնդումը մնում է չհաստատված:
Հակասությունների մեկ այլ կետ է մեթոդաբանությունը: Որոշ քննադատներ մատնանշում են մոդելի հնարավոր «գերուսուցումը» կամ օլիմպիական խնդիրներին մոտ տվյալների օգտագործումը, թեև OpenAI-ն պնդում է, որ մոդելը աշխատել է նոր խնդիրների վրա՝ առանց նախնական պատրաստման դրանց վրա: Նաև կան մտահոգություններ, որ պատասխանների «best-of-n» ընտրության գործընթացը կարող է լինել «դատավորներին հարմարեցման» ձև, այլ ոչ թե իրական մաթեմատիկական մտածողության ցուցադրություն:Այնուամենայնիվ, նույնիսկ սկեպտիկները ճանաչում են արդյունքի կարևորությունը: Չեննայի մաթեմատիկական ինստիտուտի Մադհավան Մուկունդը նշել է, որ մոդելի՝ բարդ ապացույցներ ստեղծելու կարողությունը անսպասելի առաջընթաց է՝ հաշվի առնելով, որ լեզվական մոդելները հաճախ «սայթաքում են» պարզ տրամաբանական խնդիրների վրա, ինչպիսիք են 9.11-ը և 9.9-ը համեմատելը:
Այնուամենայնիվ, նույնիսկ սկեպտիկները ճանաչում են արդյունքի կարևորությունը: Չեննայի մաթեմատիկական ինստիտուտի Մադհավան Մուկունդը նշել է, որ մոդելի՝ բարդ ապացույցներ ստեղծելու կարողությունը անսպասելի առաջընթաց է՝ հաշվի առնելով, որ լեզվական մոդելները հաճախ «սայթաքում են» պարզ տրամաբանական խնդիրների վրա, ինչպիսիք են 9.11-ը և 9.9-ը համեմատելը:Նշանակո
Նշանակություն և հեռանկարներ
OpenAI-ի հաջողությունը հեռուն գնացող հետևանքներ ունի: Նախ, այն ցույց է տալիս, որ ԱԲ-ն կարող է հասնել մարդկային մակարդակի խնդիրներում, որոնք պահանջում են խորը ստեղծագործ մտածողություն, ինչը նախկինում համարվում էր անհասանելի: Սա ճանապարհ է բացում ԱԲ-ի կիրառման համար այնպիսի ոլորտներում, ինչպիսիք են կրիպտոգրաֆիան, ֆիզիկան կամ տիեզերական հետազոտությունները, որտեղ անհրաժեշտ են բարդ բազմաքայլ հաշվարկներ: Երկրորդ, ձեռքբերումը ընդգծում է առաջընթացը համընդհանուր մոդելների ստեղծման գործում, որոնք կարող են խնդիրներ լուծել ոչ միայն մաթեմատիկայում, այլև այլ կարգապահություններում:
Այնուամենայնիվ, մոդելը դեռ պատրաստ չէ հանրային թողարկման համար: Վեյը և Ալթմանը պարզաբանել են, որ այն փորձարարական է և առաջիկա ամիսներին հասանելի չի լինի, նույնիսկ սպասվող GPT-5-ի կազմում: Սա կապված է հետագա թեստավորման և հուսալիության ապահովման անհրաժեշտության հետ՝ սխալների կամ սխալ օգտագործման խուսափելու համար: Հետաքրքիր է, որ նույն ժամանակ մեկ այլ OpenAI մոդել պարտվել է մարդուն AtCoder ծրագրավորման մրցույթում՝ ցույց տալով, որ ԱԲ-ն դեռևս չի գերազանցում մարդկանց բոլոր ոլորտներում:Կան նաև լուրեր, որ Google DeepM
Կան նաև լուրեր, որ Google DeepMind-ը նույնպես 2025 թվականի IMO-ում հասել է ոսկե մեդալի մակարդակի իր մոդելով, սակայն ընկերությունից պաշտոնական հաստատում դեռ չկա: Սա ցույց է տալիս առաջատար ԱԲ լաբորատորիաների միջև աճող մրցակցությունը համընդհանուր բանականության հասնելու գործում:
Եզրակացություն
OpenAI-ի ձեռքբերումը IMO 2025-ում արհեստական բանականության զարգացման կարևոր իրադարձություն է, որը ցույց է տալիս, որ լեզվական մոդելները կարող են ոչ միայն մշակել տվյալներ, այլև մտածել մարդկության լավագույն մտքերի մակարդակով: Վեց խնդիրներից հինգի լուծումը հաստատում է ընդհանուր մտածող կարողություններով ԱԲ-ի ստեղծման առաջընթացը՝ մեզ մոտեցնելով արհեստական ընդհանուր բանականությանը: Այնուամենայնիվ, արդյունքների շուրջ հակասությունները և դրանց չհաստատված կարգավիճակը հիշեցնում են մանրակրկիտ ստուգման և թափանցիկության անհրաժեշտության մասին: Ապագայում նման մոդելները կարող են դառնալ գիտական հետազոտությունների արժեքավոր օգնականներ, բայց առայժմ դրանք մնում են փորձարարական՝ թողնելով տեղ կատարելագործման և քննարկումների համար: