Учёные из Университета Карнеги-Меллон (CMU) разработали алгоритм Kirigami, который защищает вашу личную жизнь от любопытных микрофонов в умных устройствах. Он позволяет гаджетам, таким как колонки или камеры, анализировать звуки — например, шум готовки или уборки — без риска записать ваши разговоры. Это открытие обещает сделать технологии Интернета вещей безопаснее и этичнее. Рассказываем, как работает Kirigami, почему он нужен и как изменит нашу жизнь.
Что такое Kirigami и как он работает?
Kirigami — это алгоритм, названный в честь японского искусства вырезания бумаги, который «вырезает» человеческую речь из аудиопотока прямо на устройстве. Его задача — разрешить умным гаджетам собирать полезные данные (например, звуки шагов или работы пылесоса) без улавливания разговоров. В отличие от традиционных методов, где данные сначала отправляются в облако, Kirigami фильтрует звук локально, до передачи.
Принцип работы прост, но гениален:
- Бинарный классификатор: алгоритм анализирует аудиосигнал в реальном времени и определяет, есть ли в нём речь, используя машинное обучение.
- Фильтрация: если речь обнаружена, эти фрагменты удаляются, оставляя только «безопасные» звуки, такие как шум воды или стук посуды.
- Настройка строгости: пользователи могут выбрать уровень фильтрации. Высокая строгость минимизирует утечки речи, но может убрать часть фоновых звуков. Низкая — сохраняет больше звуков, но менее надёжна.
Тесты показали, что Kirigami снижает риск восстановления речи до 0,1% даже при использовании ИИ, таких как Whisper от OpenAI, которые могут расшифровывать искажённые аудио. Алгоритм настолько лёгкий, что работает на простых микроконтроллерах, как в недорогих умных розетках.
Почему это важно?
Умные устройства — колонки, камеры, часы — уже в 2,5 миллиардах домов по данным Statista (2025). Они слушают нас, чтобы реагировать на команды или анализировать поведение, но это создаёт угрозу приватности:
- Утечки разговоров: в 2023 году Amazon оштрафовали на $25 млн за сбор данных детей через Alexa. Пользователи на X жалуются, что умные колонки записывают личные беседы.
- Взломы: хакеры могут перехватить аудио с устройств, как в случае с уязвимостью Ring в 2022 году.
- ИИ-риски: модели, такие как Whisper, восстанавливают речь из зашумлённых записей с точностью до 90%, обходя старые методы защиты (маскировку или искажение).
Текущие решения — шифрование или частичная обработка — не спасают: данные всё равно уходят в облако, где их могут расшифровать. Kirigami решает проблему на корню, не позволяя речи покидать устройство. Это как поставить замок на микрофон.
Где пригодится Kirigami?
Алгоритм открывает двери для безопасных технологий в разных сферах:
- Умные дома: колонки или камеры смогут следить за безопасностью (например, шум упавшего предмета) без записи разговоров.
- Медицина: мониторинг пациентов с деменцией или Альцгеймером через звуки (шаги, открытие дверей) без нарушения приватности. В США такие системы уже тестируют в клиниках.
- Образование: выявление депрессии у студентов по звукам окружения (тишина, хаотичные шумы) без анализа их бесед.
- Офисы: контроль за рабочей средой, например, шум принтеров или кофе-машин, без подслушивания встреч.
В Сюнъане, китайском «городе будущего», IoT-устройства с похожими фильтрами уже тестируют для умных домов, и Kirigami мог бы усилить их приватность. Пользователи на X называют его «будущим этичного IoT», сравнивая с «глушилкой для шпионов».
Плюсы и вызовы
Плюсы:
- Локальная обработка: данные не уходят в облако.
- Гибкость: настройка под разные задачи.
- Доступность: работает на дешёвых чипах, снижая стоимость устройств.
- Защита от ИИ: блокирует даже продвинутые модели восстановления речи.
Вызовы:
- При высокой строгости теряются полезные звуки, например, звонок телефона.
- Требуется обучение для разных языков и акцентов, чтобы не пропускать речь.
- Производители должны внедрить Kirigami в устройства, что займёт 1–2 года.
Команда CMU уже тестирует алгоритм на умных колонках и камерах в университетских кампусах. По их словам, точность распознавания речи достигает 99,8%, а задержка обработки — менее 10 мс, что незаметно для пользователя.
Контекст: приватность в эпоху IoT
Спрос на защиту данных растёт: в 2024 году 70% пользователей в США отказались от умных устройств из-за страха прослушки (Pew Research). Европа ужесточает законы GDPR, требуя локальную обработку данных. Технологии, такие как 10G-интернет в Китае, ускоряют передачу данных, но увеличивают риски утечек. Kirigami отвечает на эти вызовы, предлагая решение, которое не жертвует функциональностью ради безопасности.
Аналоги есть: Apple использует локальную обработку Siri на iPhone, а Google тестирует Privacy Sandbox для Chrome. Но Kirigami уникален своей простотой и узкой специализацией на аудио, что делает его доступным для бюджетных устройств, вроде умных розеток за $20.
Что дальше?
CMU планирует открыть исходный код Kirigami в 2026 году, чтобы производители, такие как Amazon или Xiaomi, интегрировали его в устройства. Первые коммерческие продукты с Kirigami могут появиться в 2027 году, начиная с медицинских гаджетов. Исследователи также работают над версией для видео, чтобы фильтровать лица или текст в кадре. В будущем алгоритм может стать стандартом для IoT, как шифрование для мессенджеров.
Kirigami — это не просто алгоритм, а шаг к умным домам, где технологии служат, а не шпионят. Фильтруя речь на уровне микрофона, он защищает ваши разговоры от хакеров и ИИ. От больниц до офисов — этот «вырезатель звука» обещает сделать IoT этичным.






