В среду китайская лаборатория ИИ DeepSeek представила предварительные версии долгожданной модели V4, опубликовав в открытом доступе два варианта, которые, по заявлению компании, по возможностям не уступают самым мощным закрытым ИИ-системам мира — и при этом стоят значительно дешевле. Этот релиз стал самым амбициозным выпуском DeepSeek со времён модели R1, которая потрясла мировые рынки ИИ в начале 2025 года.
Две модели, миллион токенов
DeepSeek объявила о релизе в своём официальном аккаунте в X, сообщив, что «DeepSeek-V4 Preview официально запущена и открыта для всех» и провозгласив наступление «эпохи экономичного контекстного окна в 1 млн токенов». В тот же день компания опубликовала веса модели и технический отчёт на Hugging Face.
Флагманская DeepSeek-V4-Pro насчитывает 1,6 триллиона параметров в общей сложности, из которых 49 миллиардов активируется на каждый токен. Облегчённая версия DeepSeek-V4-Flash содержит 284 миллиарда параметров с 13 миллиардами активных. Обе модели построены на архитектуре Mixture-of-Experts и поддерживают контекстное окно в один миллион токенов — одно из крупнейших в отрасли. Новый гибридный механизм внимания, сочетающий Compressed Sparse Attention и Heavily Compressed Attention, позволяет V4-Pro использовать лишь 27% вычислительных ресурсов при инференсе и 10% кэш-памяти по сравнению с предшественником — DeepSeek-V3.2 — при том же размере контекстного окна.
Бенчмарки и цены
По собственным данным DeepSeek, V4-Pro в режиме максимальных рассуждений набрал 93,5 балла на LiveCodeBench и достиг рейтинга 3206 на Codeforces, опередив Gemini-3.1-Pro от Google и GPT-5.4 от OpenAI по обоим показателям. На широко отслеживаемом SWE-bench Verified V4-Pro набрал 80,6% — в пределах одного процентного пункта от Opus-4.6 компании Anthropic, лидирующего с показателем 80,8%. В техническом отчёте V4-Pro-Max описывается как «лучшая из доступных сегодня моделей с открытым исходным кодом», хотя по ряду бенчмарков в области знаний и агентных задач она уступает закрытым лидерам рынка.
Ценообразование может оказаться столь же революционным, как и результаты бенчмарков. V4-Flash предлагается по цене $0,14 за миллион входных токенов и $0,28 за миллион выходных токенов, тогда как V4-Pro стоит $1,74 и $3,48 соответственно — согласно опубликованному тарифному плану компании. Это делает V4-Pro примерно втрое дешевле GPT-5.5 по входным токенам и почти в девять раз дешевле по выходным, согласно анализу Apidog.
month
week
day