Ֆրիլանսերները պահանջում են աշխատավարձի բարձրացու՞մ ինֆլյացիայի ֆոնին: Կարելի է փորձել փոխարինել նրանց ԱԲ-գործակալներով: Ճիշտ է, սա, ամենայն հավանականությամբ, կավարտվի ձախողմամբ:
Ինչպես պատմում է Futurism.com-ը, Wired-ում լուսաբանված նոր հետազոտությունը ցույց է տալիս, թե որքան անարդյունավետ են ԱԲ-մոդելները, որոնք նախատեսված են առաջադրանքների՝ եթե ոչ ամբողջ մասնագիտությունների՝ ավտոմատացման համար, համեմատած մարդկանց հետ, որոնց նրանք կոչված են տեղահանել: Թեստերը անցկացրել են ոչ առևտրային ԱԲ-անվտանգության կենտրոնի (CAIS) և Scale AI տվյալների անոտացիայի խոշոր ընկերության հետազոտողները, որոնց ֆրիլանսերները կատարում են ԱԲ-արդյունաբերության հետևում կանգնած ռուտինային աշխատանքի մեծ մասը: Նրանք վստահել են վեց առաջատար ԱԲ-գործակալներին տարբեր սիմուլյացված ֆրիլանս-առաջադրանքներ:
Նոր հոդվածում նկարագրված արդյունքները հուսահատեցնող են: Ոչ մի ԱԲ-գործակալ չի կատարել ավելի քան 3% աշխատանքներ՝ վաստակելով ընդամենը 1810 դոլար հնարավոր 143 991-ից:
«Հուսով եմ, սա կտա ԱԲ-ի իրական հնարավորությունների ավելի ճշգրիտ պատկերացում», — Wired-ին ասել է CAIS-ի տնօրեն Դեն Հենդրիքսը:
Նոր բենչմարկ՝ Remote Labor Index
Թեստերի համար հետազոտողները մշակել են սեփական բենչմարկ՝ Remote Labor Index (RLI), որը գնահատում է բոտերի կարողությունը կատարել տնտեսապես արժեքավոր աշխատանք խաղերի մշակումից մինչև տվյալների վերլուծություն ոլորտներում: Բենչմարկը ներառում է 240 իրական հեռավար նախագծեր 23 դոմեյններից՝ վերցված ֆրիլանս-պլատֆորմներից: Յուրաքանչյուր նախագիծ ամբողջական, ինքնաբավ առաջադրանք է, որը մարդուց պահանջում է միջինը 11,5 ժամ և գնահատվում է 200 դոլարով:
RLI-ն ստուգում է, թե արդյոք ԱԲ-ն կարող է ավարտել ամբողջ նախագիծը սկզբից մինչև վերջ իրական պատվերի ընդունելի մակարդակով, այլ ոչ թե պարզապես օգնել մասերում: Գնահատումը կատարվել է ձեռքով՝ փորձագետների կողմից, համեմատելով ԱԲ-ի արդյունքները մարդկային աշխատանքների «ոսկե ստանդարտի» հետ: Անոտատորների համաձայնությունը գերազանցել է 90%-ը:
Լավագույն արդյունքը ցույց է տվել չինական Manus ստարտափի ԱԲ-գործակալը՝ ընդամենը 2,5% ավտոմատացում, այսինքն՝ ավարտել է ընդունելի մակարդակով միայն 2,5% նախագծեր: Երկրորդ տեղում (2,1%)՝ ոչ-ոքի Էլոն Մասկի Grok 4-ի և Anthropic-ի Claude Sonnet 4.5-ի միջև, որը ընկերությունը անվանում է «կոդավորման աշխարհում լավագույն մոդել» և «ամենահզորագույն բարդ գործակալներ ստեղծելու համար»:
Հետո գալիս է OpenAI-ի նորագույն GPT-5-ը իր «PhD մակարդակի ինտելեկտով»՝ 1,7%: OpenAI-ի գլխավոր տնօրեն Սեմ Ալթմանը հայտարարել էր, որ GPT-5-ը «զգալի քայլ է դեպի AGI» (արհեստական ընդհանուր ինտելեկտ), որը գերազանցում է մարդուն տնտեսապես արժեքավոր աշխատանքի մեծ մասում: Սակայն RLI-ն ցույց է տալիս՝ դեռ հեռու է դրան:
Իրոնիան այն է, որ OpenAI-ի մասնագիտացված գործակալը՝ ChatGPT Agent անունով, ցույց է տվել երկրորդ վատագույն արդյունքը՝ 1,3%: Իսկ վատագույնը Google-ի Gemini 2.5 Pro-ն է՝ խղճալի 0,8%-ով:
Ինչու ԱԲ-ն դեռ պատրաստ չէ փոխարինել մարդկանց
ԱԲ-գործակալների վաճառքը գործատուներին արդյունաբերության մոլուցք է, որտեղ OpenAI-ի նման առաջնորդները փորձում են մոնետիզացնել չատ-բոտերի ժողովրդականությունը, որոնց շատերը անվճար են: Բայց չնայած գլխավոր տնօրենների էնտուզիազմին, որոնք ազատում են աշխատակիցներին ԱԲ-ի օգտին, հարցը, թե արդյոք ավտոմատացումը կբարձրացնի արտադրողականությունը, մնում է բաց:
«Մենք տարիներ շարունակ վիճում ենք ԱԲ-ի և աշխատատեղերի մասին, բայց հիմնականում հիպոթետիկ», — Wired-ին նշել է Scale AI-ի հետազոտությունների տնօրեն Բինգ Լյուն:
Անեկդոտիկորեն շատ ղեկավարներ, որոնք փոխարինել են աշխատակիցներին ԱԲ-ով, ստիպված են եղել վերավարձել նրանց՝ գործիքների անհամարժեքությունը հայտնաբերելով: Հետազոտությունները հաստատում են՝ MIT-ի տվյալներով, ԱԲ-նախաձեռնություններ փորձարկած ընկերությունների 95%-ը եկամուտների աճ չի տեսել: Մեկ ուրիշը ցույց է տվել, որ ԱԲ-ի ներդրումը աշխատանքային գործընթացներում հանգեցնում է ցածրորակ «workslop»-ի հոսքի՝ բովանդակություն, որը պահանջում է ուղղումներ, ինչը դանդաղեցնում է ամեն ինչ և առաջացնում լարվածություն գործընկերների միջև:
Հենդրիքսը մատնանշել է ԱԲ-գործակալների հիմնական խնդիրները. «Նրանք չունեն երկարաժամկետ հիշողություն, չեն կարող շարունակաբար սովորել փորձից: Նրանք հմտություններ չեն ձեռք բերում աշխատանքում, ինչպես մարդիկ»:
Այնուամենայնիվ, ԱԲ-ի պատճառով ազատումները շարունակվում են լիակատար թափով:
Հակիրճ…
CAIS-ի և Scale AI-ի նոր հետազոտությունը Remote Labor Index բենչմարկով ցույց է տվել՝ առաջատար ԱԲ-գործակալները (Grok 4, Claude 4.5, GPT-5) կատարում են իրական ֆրիլանս-նախագծերի պակաս քան 3%-ը՝ վաստակելով կոպեկներ մարդկանց համեմատ: Manus-ը առաջատար է 2,5%-ով, Google Gemini-ը՝ աուտսայդեր 0,8%-ով: ԱԲ-ն դեռ պատրաստ չէ աշխատանքի ավտոմատացմանը՝ հիշողության, սովորելու և որակի բացակայություն: Սա կասկածի տակ է դնում աշխատակիցների փոխարինման հայպը, բայց առաջընթացը չափելի է՝ խաղադրույքները աճում են:






