Компания DeepSeek без особого шума представила обновление своего приложения до версии 1.7.4, привнеся радикальные изменения. Контекстное окно было расширено с 128 тысяч токенов до более чем миллиона, а база знаний обновлена до мая 2025 года. Важным моментом стало то, что чатбот самоуверенно заявляет о себе как о «финальной эволюционной форме V3» и «последней версии перед запуском V4».
Аналитики Nomura Securities, в своем отчете от 10 февраля, отметили, что новая модель DeepSeek уже демонстрирует способности, сопоставимые с Gemini 3 Pro и K2.5 в сложных задачах. Во внутренних тестах, DeepSeek V4 превзошел аналогичные решения от Claude и нынешнего поколения GPT в программировании благодаря внедрению двух новых технологий: mHC для масштабирования и Engram — модуля условной памяти, позволяющего эффективно работать с контекстом длиной более миллиона токенов.
Nomura также подчеркнула, что выход V4 не вызовет столь сильного шока на рынке, как релиз DeepSeek-R1 в прошлом году, который обвалил акции Nvidia на 600 миллиардов долларов. Основная ценность новой модели заключается в снижении стоимости тренировки и инференса, что может ускорить коммерциализацию ИИ-приложений и вызвать новый инвестиционный цикл в инфраструктуру, особенно в Китае. Тем не менее, позиции DeepSeek на рынке open-source начали ослабевать.
Обновление совпало с активной гонкой китайских ИИ-лабораторий. Zhipu только что представила модель GLM-5 с 744 миллиардами параметров, использующую технологию разреженного внимания от DeepSeek. Alibaba и ByteDance также готовят свои новинки, стремясь успеть к празднованию Лунного Нового года 17 февраля, когда, по слухам, DeepSeek планирует полный запуск V4.
