DeepSeek обещает новую революцию в ИИ: Эффективность через вознаграждение

8 апреля, 2025  15:37

Китайский стартап DeepSeek, уже прославившийся своей моделью R1 с выдающимися рассуждающими способностями, снова оказался в центре внимания. На этот раз компания анонсировала прорывной метод обучения искусственного интеллекта, разработанный в сотрудничестве с исследователями из Университета Цинхуа. Как сообщает South China Morning Post (SCMP), новый подход обещает значительно повысить эффективность больших языковых моделей (LLM), сделав их более точными и экономичными. Подробности инновации раскрыты в статье, опубликованной на прошлой неделе.

В чём суть нового метода?

DeepSeek представил технику, сочетающую генеративное моделирование вознаграждения (GRM) и самокритичную настройку на основе принципов (self-principled critique tuning). Этот метод направлен на то, чтобы ИИ лучше соответствовал человеческим ожиданиям, стимулируя его выдавать более качественные ответы через систему позитивного подкрепления. Если традиционное обучение с подкреплением (reinforcement learning) хорошо работает в узких задачах, то для общих сценариев его эффективность падала. DeepSeek устраняет этот барьер, объединяя GRM с механизмом самокоррекции.

По данным исследования, модели DeepSeek-GRM демонстрируют превосходство над существующими аналогами. Они не только точнее обрабатывают сложные и общие запросы, но и требуют меньше вычислительных ресурсов. Это особенно важно в условиях глобальной конкуренции, где снижение затрат на обучение ИИ становится ключевым преимуществом.

DeepSeek-GRM: открытый код и перспективы

Новые модели получили название DeepSeek-GRM (Generalist Reward Modeling), подчеркивающее их универсальность. Компания планирует сделать их доступными с открытым исходным кодом, следуя своей традиции делиться разработками с сообществом. Напомним, что в начале 2025 года DeepSeek уже потряс рынок, выпустив модель R1, которая обошла многие западные аналоги по производительности при меньших затратах. Однако точной даты релиза GRM-моделей пока нет — исследователи лишь подтвердили намерение открыть доступ в будущем.

Почему это важно?

Успех DeepSeek-GRM может стать очередным ударом по мифу о недосягаемом лидерстве американских ИИ-гигантов вроде OpenAI. Китайский стартап доказывает, что инновации в области ИИ не требуют миллиардов долларов и доступа к самым передовым чипам. Сотрудничество с Университетом Цинхуа подчеркивает роль академической базы в успехе DeepSeek: местные специалисты помогли создать метод, который оптимизирует ресурсы и повышает адаптивность моделей.

Тестирование показало, что GRM-модели особенно эффективны в задачах, требующих рассуждений и генерации текста, близкого к человеческому восприятию. Это открывает перспективы для их использования в самых разных сферах — от чат-ботов до автоматизации аналитики и образования.

Чего ждать дальше?

DeepSeek продолжает менять правила игры в мировой ИИ-индустрии. После успеха R1, который в январе 2025 года обрушил акции американских техно-гигантов на $1 трлн, новый анонс только усиливает ожидания вокруг следующей модели компании. Если GRM оправдает обещания, это может ускорить переход отрасли к более доступным и эффективным решениям, где Китай станет лидером не только по стоимости, но и по качеству.

Пока сроки релиза остаются загадкой, одно ясно точно: DeepSeek не собирается останавливаться. Этот стартап из Ханчжоу снова доказывает, что революция в ИИ может прийти не из Кремниевой долины, а из Китая — с открытым кодом и свежими идеями в придачу.

Следите за NEWS.am Tech на Facebook и Twitter