Бешеный интерес к ИИ-чат-боту, созданному китайским стартапом DeepSeek, в понедельник потряс фондовые рынки и вызвал дебаты об экономической и геополитической конкуренции между США и Китаем в сфере разработки технологий ИИ. ИИ-ассистент DeepSeek стал самым скачиваемым бесплатным приложением в магазине iPhone Apple в понедельник и вызвал падение акций технологических компаний.

Может ли быстрый прогресс китайских разработчиков серьезно изменить глобальную технологическую экосистему и в чем причина ажиотажа? Редакция NEWS.am Tech решила разобраться в этих вопросах.

Китайский стартап бросает вызов OpenAI 

Китайский стартап DeepSeek потряс индустрию выпуском новой модели, которая сопоставима по возможностям с последней разработкой OpenAI, но при этом потребовала гораздо меньших инвестиций и использует менее мощные чипы. По результатам стандартных тестов на математические и программные способности DeepSeek-R1 показал те же результаты, что и модель OpenAI o1, сообщает VentureBeat. Стоимость разработки DeepSeek-R1 оценивается в 6 миллионов долларов, при этом, улучшенная энергоэффективность модели делает ее более доступной для различных сфер. 

Модель содержит 670 миллиардов параметров — это самая крупная из всех существующих открытых LLM. Однако архитектура “mixture of experts” позволяет задействовать только нужную часть параметров при обработке конкретного запроса — десятки миллиардов вместо сотен, что снижает вычислительные затраты. Кроме того, DeepSeek-R1 использует метод multi-head latent attention для повышения эффективности обработки запросов, а вместо прогнозирования текста слово за словом генерирует сразу несколько слов. Еще одно важное отличие DeepSeek-R1 от конкурентов, таких как OpenAI o1, заключается в механизме обучения. Многие LLM используют внешний «критик» — дополнительную модель, которая анализирует и корректирует ответы. В DeepSeek-R1 же встроен внутренний механизм самооценки, который помогает модели выбирать лучший из возможных вариантов ответа, пишет Scientific American.

Быть вторым иногда даже выгоднее

Руководитель группы машинного обучения ЕрГУ и директор фонда “ЕреванЭн” Грант Хачатрян в беседе с NEWS.am Tech отметил: «Было ожидаемо, что рано или поздно такие сложные модели, как OpenAI GPT, можно будет создавать с меньшими ресурсами. Тем не менее, впечатляет, что китайским компаниям удается находить пути для создания мощных моделей при ограниченных ресурсах. Еще более поразительно, с какой скоростью они это делают. Если год назад открытая модель, сопоставимая по возможностям с самой мощной закрытой, появлялась спустя год, то теперь этот разрыв сократился до трех-четырех месяцев. Например, китайская компания DeepSeek представила модель R1, способную решать математические задачи и задачи программирования. OpenAI запустил аналогичный продукт в сентябре, а это значит, что всего за четыре месяца китайская компания достигла схожих результатов, используя открытый код и меньшие вычислительные мощности».

Говоря об успехах китайского разработчика, он добавил: «Создать модель нового уровня впервые — крайне сложная задача. Но когда уже есть готовый продукт, когда ты видишь, что OpenAI его разработал, появляется уверенность, что это можно повторить. В этом смысле быть вторым иногда даже выгоднее».

Дефицит ресурсов — мать инноваций

За драмой по поводу технических возможностей DeepSeek скрывается стремление США не допустить конкурентных преимуществ Китая в особенности в области ИИ, но в данном случае результат действий Вашингтона оказался прямо противоположен поставленным целям. 

Грант Хачатрян напомнил, что в 2023 году правительство США запретило NVIDIA экспортировать в Китай передовые чипы, из-за чего компания выпустила ослабленные версии специально для китайского рынка. Однако спустя несколько месяцев санкции ужесточили, полностью запретив поставки чипов этой категории. Эксперт уверен, что, несмотря на введенные США санкции, официально ограничивающие доступ Китая к мощным вычислительным ресурсам, на практике их в стране больше, чем кажется. 

«Обходные пути существуют, и каким-то образом эти чипы все же попадают в Китай. Конечно, их объемы не могут превышать те, что есть у OpenAI, но именно этот дефицит побуждает китайские компании к инновациям. Дефицит ресурсов — мать инноваций. Когда у тебя нет всего необходимого, приходится искать нестандартные решения и идти на риск. У OpenAI такой необходимости нет», — подчеркнул Хачатрян.

Директор Центра искусственного интеллекта и передовых технологий Вадхвани Грегори Аллен заявил PBC News: “Технологическая инновация реальна, но сроки выпуска носят политический характер. Это попытка показать, что экспортный контроль бесполезен или контрпродуктивен. Именно это и является действительно важной целью внешней политики Китая прямо сейчас».

Не единственная заявка Китая

DeepSeek — далеко не единственная заявка Китая: не дремлет и компания Alibaba.

Председатель совета попечителей образовательного фонда «Айб» Арам Пахчанян на своей странице в социальной сети Facebook обратил внимание пользователей на разработку компании.  “Пока мы восхищались абсолютным ураганом, который принес DeepSeek, потрясшим всю экосистему информационных технологий США, Alibaba без лишнего шума представила новую, значительно улучшенную версию своего ИИ Qwen — 2.5. Она, опять же, бесплатна. Может не только умно отвечать на вопросы, но и создавать изображения, а также даже видеоролики. У модели есть разные подверсии для различных задач. Для армянского языка следует использовать самую мощную версию — Qwen 2.5 Max. Пока она работает немного медленно, вероятно, из-за высокой нагрузки, но удивительно умна. На первый взгляд, ничем не уступает ChatGPT”.

Чего ждать дальше? Ускорения!

С усилением конкурентоспособности китайских стартапов в области искусственного интеллекта (ИИ) и их достижениями, такими как DeepSeek и Qwen-2.5, рынок ИИ может пережить несколько значительных изменений, среди которых рост конкуренции. И это будет связано не только с деятельностью китайских стартапов, но и с активизацией внутренней конкуренции. 

Грант Хачатряна не исключает, что сейчас многие компании могут последовать примеру Китая. «Недавно я слушал интервью главы одной американской компании, разрабатывающей поисковую систему с использованием ИИ. Он говорил, что изначально они не собирались конкурировать с OpenAI, а планировали использовать его технологии. Но теперь, когда все воочию убедились, чего можно достичь малыми ресурсами, компания задумалась о создании собственной модели».

Кроме того, развернувшаяся на фоне успеха китайских стартапов гонка может привести к существенному технологическому ускорению. Китайские стартапы, несмотря на ограниченные ресурсы, продемонстрировали способность быстро разрабатывать мощные модели ИИ. Этот технологический импульс может ускорить инновации в области ИИ, что может повлиять на все крупные компании и ускорить внедрение новых решений.