Քարնեգի-Մելոն համալսարանի (CMU) գիտնականները մշակել են Kirigami ալգորիթմը, որը պաշտպանում է Ձեր անձնական կյանքը խելացի սարքերի հետաքրքրասեր միկրոֆոններից: Այն թույլ է տալիս գաջեթներին, ինչպիսիք են բարձրախոսները կամ տեսախցիկները, վերլուծել ձայները՝ օրինակ՝ ճաշ պատրաստելու կամ մաքրելու աղմուկը, առանց Ձեր խոսակցությունները գրանցելու ռիսկի: Այս հայտնագործությունը խոստանում է Իրերի Ինտերնետի (IoT) տեխնոլոգիաներն ավելի անվտանգ և էթիկական դարձնել: Պատմում ենք, թե ինչպես է աշխատում Kirigami-ն, ինչու է այն անհրաժեշտ և ինչպես կփոխի մեր կյանքը:
Ի՞նչ է Kirigami-ն և ինչպե՞ս է այն աշխատում
Kirigami-ն ալգորիթմ է, որն անվանվել է ճապոնական թղթի կտրման արվեստի պատվին, որը «կտրում է» մարդկային խոսքը աուդիոհոսքից անմիջապես սարքի վրա: Նրա նպատակն է թույլ տալ խելացի գաջեթներին հավաքել օգտակար տվյալներ (օրինակ՝ քայլերի կամ փոշեկուլի աշխատանքի ձայներ)՝ առանց խոսակցություններ ընկալելու: Ի տարբերություն ավանդական մեթոդների, որտեղ տվյալներն առաջինը ուղարկվում են ամպ, Kirigami-ն ֆիլտրում է ձայնը լոկալ՝ մինչև փոխանցումը:
Աշխատանքի սկզբունքը պարզ է, բայց հանճարեղ.
- Երկուական դասակարգիչ. Ալգորիթմը վերլուծում է աուդիո ազդանշանը իրական ժամանակում և որոշում է, թե արդյոք այն պարունակում է խոսք՝ օգտագործելով մեքենայական ուսուցում:
- Ֆիլտրում. Եթե խոսք է հայտնաբերվում, այդ հատվածները հեռացվում են՝ թողնելով միայն «անվտանգ» ձայներ, ինչպիսիք են ջրի աղմուկը կամ սպասքի ձայնը:
- Խստության կարգավորում. Օգտատերերը կարող են ընտրել ֆիլտրման մակարդակը: Բարձր խստությունը նվազագույնի է հասցնում խոսքի արտահոսքը, բայց կարող է հեռացնել որոշ ֆոնային ձայներ: Ցածր խստությունը պահպանում է ավելի շատ ձայներ, բայց պակաս հուսալի է:
Թեստերը ցույց են տվել, որ Kirigami-ն խոսքի վերականգնման ռիսկը հասցնում է 0.1%-ի՝ նույնիսկ OpenAI-ի Whisper-ի նման ԻՀ-երի օգտագործման դեպքում, որոնք կարող են վերծանել աղավաղված աուդիոն: Ալգորիթմն այնքան թեթև է, որ աշխատում է պարզ միկրոկոնտրոլերների վրա, ինչպիսիք օգտագործվում են էժան խելացի վարդակներում:
Ինչու՞ է սա կարևոր
Խելացի սարքերը՝ բարձրախոսներ, տեսախցիկներ, ժամացույցներ, 2025 թվականի տվյալներով՝ Statista-ի համաձայն, առկա են 2.5 միլիարդ տանը: Նրանք լսում են մեզ՝ հրամաններին արձագանքելու կամ վարքագիծը վերլուծելու համար, սակայն սա ստեղծում է գաղտնիության սպառնալիք.
- Խոսակցությունների արտահոսք. 2023 թվականին Amazon-ը տուգանվել է 25 միլիոն դոլարով երեխաների տվյալների հավաքագրման համար Alexa-ի միջոցով: X-ի օգտատերերը բողոքում են, որ խելացի բարձրախոսները գրանցում են անձնական զրույցները:
- Հաքերային հարձակումներ. Հաքերները կարող են գրավել աուդիոն սարքերից, ինչպես դա եղավ Ring-ի խոցելիության դեպքում 2022 թվականին:
- ԻՀ-ի ռիսկեր. Whisper-ի նման մոդելները վերականգնում են խոսքը աղմկոտ ձայնագրություններից մինչև 90% ճշգրտությամբ՝ շրջանցելով հին պաշտպանության մեթոդները (դիմակավորում կամ աղավաղում):
Ընթացիկ լուծումները՝ կոդավորումը կամ մասնակի մշակումը, չեն փրկում. տվյալները, այնուամենայնիվ, գնում են ամպ, որտեղ դրանք կարող են վերծանվել: Kirigami-ն լուծում է խնդիրը արմատից՝ թույլ չտալով, որ խոսքը լքի սարքը: Սա նման է միկրոֆոնի վրա կողպեք դնելուն:
Որտե՞ղ կօգտագործվի Kirigami-ն
Ալգորիթմը բացում է դռները անվտանգ տեխնոլոգիաների համար տարբեր ոլորտներում.
- Խելացի տներ. Բարձրախոսները կամ տեսախցիկները կարող են հետևել անվտանգությանը (օրինակ՝ ընկած առարկայի աղմուկ)՝ առանց խոսակցություններ գրանցելու:
- Բժշկություն. Հիվանդների մոնիթորինգ դեմենցիայով կամ Ալցհեյմերով ձայների միջոցով (քայլեր, դռան բացում)՝ առանց գաղտնիության խախտման: ԱՄՆ-ում նման համակարգերն արդեն փորձարկվում են կլինիկաներում:
- Կրթություն. Ուսանողների մոտ դեպրեսիայի հայտնաբերում շրջակա միջավայրի ձայների միջոցով (լռություն, խառնաշփոթ ձայներ)՝ առանց նրանց զրույցների վերլուծության:
- Գրասենյակներ. Աշխատանքային միջավայրի վերահսկողություն, օրինակ՝ տպիչների կամ սուրճի մեքենաների աղմուկ, առանց հանդիպումների գաղտնալսման:
Չինաստանի «ապագայի քաղաք» Սյունանում IoT սարքերը նման ֆիլտրերով արդեն փորձարկվում են խելացի տների համար, և Kirigami-ն կարող է ուժեղացնել դրանց գաղտնիությունը: X-ի օգտատերերն այն անվանում են «էթիկական IoT-ի ապագա»՝ համեմատելով «լրտեսների համար խլացուցիչի» հետ:
Դրական կողմեր և մարտահրավերներ
Դրական կողմեր.
- Լոկալ մշակում. Տվյալները չեն լքում սարքը:
- Ճկունություն. Կարգավորում տարբեր առաջադրանքների համար:
- Հասանելիություն. Աշխատում է էժան չիպերի վրա՝ նվազեցնելով սարքերի արժեքը:
- ԻՀ-ից պաշտպանություն. Արգելափակում է նույնիսկ խոսքի վերականգնման առաջադեմ մոդելները:
Մարտահրավերներ.
- Բարձր խստության դեպքում կորում են օգտակար ձայներ, օրինակ՝ հեռախոսի զանգը:
- Պահանջվում է ուսուցում տարբեր լեզուների և առոգանությունների համար՝ խոսքը բաց չթողնելու համար:
- Արտադրողները պետք է ներդնեն Kirigami-ն սարքերում, ինչը կտևի 1–2 տարի:
CMU-ի թիմն արդեն փորձարկում է ալգորիթմը խելացի բարձրախոսների և տեսախցիկների վրա համալսարանական կամպուսներում: Նրանց խոսքով՝ խոսքի ճանաչման ճշգրտությունը հասնում է 99.8%-ի, իսկ մշակման ուշացումը՝ 10 մվ-ից պակաս, ինչն աննկատ է օգտատիրոջ համար:
Համատեքստ. Գաղտնիություն IoT-ի դարաշրջանում
Տվյալների պաշտպանության պահանջարկն աճում է. 2024 թվականին ԱՄՆ-ում օգտատերերի 70%-ը հրաժարվել է խելացի սարքերից՝ գաղտնալսման վախի պատճառով (Pew Research): Եվրոպան խստացնում է GDPR օրենքները՝ պահանջելով տվյալների լոկալ մշակում: Տեխնոլոգիաները, ինչպիսին է Չինաստանի 10G ինտերնետը, արագացնում են տվյալների փոխանցումը, բայց մեծացնում են արտահոսքի ռիսկերը: Kirigami-ն արձագանքում է այդ մարտահրավերներին՝ առաջարկելով լուծում, որը չի զոհաբերում ֆունկցիոնալությունը հանուն անվտանգության:
Անալոգներ կան. Apple-ն օգտագործում է Siri-ի լոկալ մշակում iPhone-ներում, իսկ Google-ը փորձարկում է Privacy Sandbox-ը Chrome-ի համար: Սակայն Kirigami-ն եզակի է իր պարզությամբ և աուդիոյի նեղ մասնագիտացմամբ, ինչը նրան հասանելի է դարձնում բյուջետային սարքերի համար, օրինակ՝ 20 դոլար արժողությամբ խելացի վարդակների:
Ի՞նչ է սպասվում
CMU-ն պլանավորում է բացել Kirigami-ի սկզբնակոդը 2026 թվականին, որպեսզի Amazon-ի կամ Xiaomi-ի նման արտադրողները ինտեգրեն այն սարքերում: Առաջին առևտրային արտադրանքները Kirigami-ով կարող են հայտնվել 2027 թվականին՝ սկսած բժշկական գաջեթներից: Հետազոտողները նաև աշխատում են տեսանյութերի համար նախատեսված տարբերակի վրա՝ կադրերում դեմքեր կամ տեքստ ֆիլտրելու համար: Ապագայում ալգորիթմը կարող է դառնալ IoT-ի ստանդարտ, ինչպես կոդավորումն է մեսենջերների համար:
Եզրակացություն
Kirigami-ն ոչ միայն ալգորիթմ է, այլև քայլ դեպի խելացի տներ, որտեղ տեխնոլոգիաները ծառայում են, այլ ոչ թե լրտեսում: Միկրոֆոնի մակարդակով խոսքը ֆիլտրելով՝ այն պաշտպանում է Ձեր խոսակցությունները հաքերներից և ԻՀ-ից: Հիվանդանոցներից մինչև գրասենյակներ՝ այս «ձայնի կտրիչը» խոստանում է IoT-ն դարձնել էթիկական:






