Google-ը ներկայացրել է Gemini 4 Argon-ը՝ արհեստական բանականության նոր մոդել, որը ընկերությունը անվանում է իր շարքի ամենահզորը։ Argon-ը նախատեսված է ծրագրավորման, ճարտարագիտության, հետազոտությունների և տեքստերի հետ աշխատանքի բարդ խնդիրների համար, սակայն Google-ը դրա կիրառման գլխավոր ոլորտը համարում է կիբեռանվտանգությունը։
Առայժմ մոդելը հասանելի չէ բոլորին․ ընկերությունը այն տրամադրել է անվտանգության ոլորտի սահմանափակ թվով գործընկերների՝ իր Fairwind ծրագրի շրջանակում։ Argon-ը հատուկ ուսուցանվել է կիբեռանվտանգության պաշտպանական խնդիրների համար, և Google-ը պնդում է, որ մոդելը կարող է ինքնավար կերպով հայտնաբերել, ստուգել և շտկել ծրագրային ապահովման կրիտիկական խոցելիությունները։
ԱԲ, որը փնտրում է խոցելիություններն ու ինքն է շտկում դրանք
Google-ը շեշտադրում է Argon-ի կարողությունը՝ կատարել փոխկապակցված գործողությունների երկար հաջորդականություններ՝ առանց մարդու մշտական մասնակցության։ Ընկերությունում ասում են, որ մոդելը ստեղծվել է բարդ խնդիրների հետ աշխատելու համար, որոնք պահանջում են խորը դատողություն և երկարատև կատարում։
Կիբեռանվտանգության ոլորտում դա նշանակում է անցում՝ առաջարկությունների պարզ գեներացումից դեպի կոդի հետ ավելի ինքնուրույն աշխատանք։ Argon-ը պետք է հայտնաբերի հնարավոր խոցելիությունը, ստուգի՝ արդյոք այն իսկապես գոյություն ունի, ապա պատրաստի և կիրառի շտկումը։
Հենց այդ պատճառով էլ Google-ը առայժմ մոդելը չի բացում լայն օգտագործման համար։ Argon-ը տարածվում է անվտանգության ընտրված գործընկերների շրջանում Fairwind-ի միջոցով՝ ընկերության թվային ենթակառուցվածքի պաշտպանությանը նվիրված ծրագրի։
Մոդելն արդեն օգտագործվում է Google-ի ներսում
Argon-ի հնարավորությունները չեն սահմանափակվում միայն կիբեռանվտանգությամբ։ Google-ը այն նաև ներկայացնում է որպես ուժեղ մոդել ծրագրավորման և ճարտարագիտական խնդիրների համար։
Ընկերության աշխատակիցներն արդեն օգտագործում են Argon-ը առօրյա աշխատանքում՝ մասնավորապես կոդում սխալներ գտնելու և շտկելու, ինչպես նաև գոյություն ունեցող կոդային բազաները տեղափոխելու համար։
Մոդելի ևս մեկ հայտարարված կարողություն կապված է տեսողական տեղեկատվության վերլուծության հետ։ Argon-ը կարող է աշխատել ոչ միայն տեքստի և կոդի, այլև գրաֆիկների, դիագրամների և երկար տեսաձայնագրությունների հետ՝ դրանցից դուրս բերելով անհրաժեշտ տեղեկատվությունը։
Google-ում հայտարարում են, որ Argon-ը պետք է ապահովի խորը դատողություն բարդ աշխատանքային գործընթացների ողջ ընթացքում, որոնք կարող են բաղկացած լինել մեծ թվով հաջորդական առաջադրանքներից։
Google-ը Argon-ը համեմատում է մրցակիցների նորագույն մոդելների հետ
Gemini 4 Argon-ի թողարկումը տեղի է ունենում ԱԲ-ի խոշորագույն մշակողների միջև մրցավազքի նոր փուլի ֆոնին։ OpenAI-ը վերջերս ներկայացրել է Astra-ն՝ այն անվանելով իր ամենահզոր մոդելը, իսկ Anthropic-ը ավելի վաղ թողարկել էր Fable-ը և Opus-ի նոր տարբերակները։
Իր հերթին Google-ը պնդում է, որ Argon-ը տարբեր թեստերում զգալիորեն գերազանցում է GPT-6 Astra-ին և Anthropic-ի Fable ու Opus մոդելներին։ Ընկերությունը նաև հղում է անում Vals-ի՝ AI մոդելների համեմատությամբ զբաղվող ստարտափի արդյունքներին, որտեղ Argon-ն այժմ զբաղեցնում է առաջին տեղը վարկանիշում։
Միևնույն ժամանակ նման համեմատությունները պահանջում են զգուշավոր մեկնաբանություն․ արդյունքները կախված են ընտրված թեստերից և գնահատման մեթոդաբանությունից, իսկ մոդելների մշակողները իրենք շահագրգռված են իրենց համակարգերի առավելությունները ցուցադրելու մեջ։
Google-ը վերադառնում է AI մրցավազքի կենտրոն
Դեռ վերջերս Google-ը համարվում էր ամենահզոր գեներատիվ մոդելների համար մղվող մրցավազքի հետ մնացող մասնակիցներից մեկը։ Սակայն վերջին շրջանում ընկերությունը զգալիորեն ամրապնդել է Gemini-ի դիրքերը։
Օգոստոսին Google-ը հայտնել էր, որ Gemini հավելվածից ամսական օգտվում է ավելի քան մեկ միլիարդ մարդ։ Համեմատության համար՝ OpenAI-ը նույնպես հայտարարել էր, որ ChatGPT-ն հասել է ամսական մեկ միլիարդ օգտատիրոջ նշագծին։
Այժմ Google-ը կատարում է հաջորդ քայլը՝ ցույց տալով Gemini-ի հնարավորությունները ոչ միայն որպես ունիվերսալ օգնական, այլև որպես գործիք, որն ունակ է ինքնուրույն կատարել բարդ ճարտարագիտական և պաշտպանական խնդիրներ։
Հատկապես խոսուն է կիբեռանվտանգության վրա արված շեշտադրումը․ մոդելը, որը կարող է ինքնուրույն հայտնաբերել և շտկել խոցելիությունները, տեսականորեն ունակ է էապես կրճատել խնդրի հայտնաբերման և դրա վերացման միջև ընկած ժամանակը։ Բայց միաժամանակ հենց նման հնարավորություններն են պահանջում առանձնապես զգույշ վերահսկողություն՝ հատկապես եթե համակարգը հնարավորություն է ստանում ինքնուրույն փոփոխել ծրագրային կոդը։






