ԱՄԷ-ն ներկայացրել է K2 Think թեթև, բաց կոդով արհեստական բանականության մոդելը

11 սեպտեմբերի, 2025  17:07

Միացյալ Արաբական Էմիրությունները ներկայացրել են K2 Think-ը 2025 թվականի սեպտեմբերի 9-ին, ինչը երկրի ամենաբացառիկ քայլն է համաշխարհային արհեստական բանականության բեմում: Այս բաց կոդով հետազոտական մոդելը, որը մշակվել է Մուհամմադ բին Զայիդ Արհեստական Բանականության Համալսարանի (MBZUAI) և G42 տեխնոլոգիական խմբի կողմից, 32 միլիարդ պարամետրերով հասնում է այն արդյունքներին, որոնք համեմատելի են շատ ավելի մեծ AI համակարգերի հետ, հայտնում է Emirates 24/7:

K2 Think-ը ներկայացնում է այն, ինչ հետազոտողները կոչում են պարադիգմայի փոփոխություն՝ «մեծը լավն է» սկզբունքից դեպի «խելացին լավն է» մոտեցումը արհեստական բանականության զարգացման մեջ: MBZUAI-ի նախագահ Էրիկ Սինգը հայտարարել է, որ մոդելը «գերազանցում է 20 անգամ ավելի մեծ չափերով ֆլագմանային հետազոտական մոդելներին», և WIRED-ին տված հարցազրույցում նկարագրել է այն որպես «տեխնիկական բռնկում և, իմ կարծիքով, խաղը փոխող տեղաշարժ»:

Տեխնոլոգիական նորարարությունները ապահովում են արդյունավետություն

Համակարգի բռնկումը հիմնված է վեց տեխնոլոգիական սյուների վրա, որոնք ապահովում են բացառիկ արդյունավետություն՝ չնայած դրա կոմպակտ չափերին: Դրանց մեջ են մտնում՝ երկար շղթայի հետազոտություններով ուսուցումը՝ խորանալու համար տրամաբանական եզրակացությունները, ուսուցումը ամրապնդմամբ և ստուգելի պարգևներով՝ ճշգրտությունը բարձրացնելու համար, ինչպես նաև գործակալական պլանավորում, որը թույլ է տալիս մոդելին բարդ խնդիրները բաժանել փուլերի՝ տրամաբանական վերլուծության համար: Թեստավորման ընթացքում սանդղակման տեխնիկաները հետագայում բարձրացնում են հարմարվողականությունը, իսկ Cerebras սարքավորումների համար օպտիմիզացված սպեկուլյատիվ դեկոդավորումը ապահովում է աննախադեպ հզորություն:

Գործելով Cerebras wafer-scale պրոցեսորների վրա, K2 Think-ը հասնում է 2000 նշան/վայրկյան արագության, ինչը դարձնում է այն աշխարհում ամենաարագ և արդյունավետ հետազոտական համակարգերից մեկը: WIRED-ի համաձայն, այս համադրությունը թույլ է տալիս մոդելին մրցակցել կամ գերազանցել OpenAI-ի և DeepSeek-ի ավելի քան 200 միլիարդ պարամետրերով մոդելների արդյունավետությունը՝ պահանջելով զգալիորեն պակաս հաշվողական ռեսուրսներ: Մոդելը առաջատար է բոլոր open-source համակարգերի շրջանում մաթեմատիկական մտածողության չափանիշներում, ներառյալ AIME '24/'25, HMMT '25 և OMNI-Math-HARD:


 
 
 
 
  • Archive