Китайский стартап DeepSeek нацелился на выпуск своей новой флагманской модели V4 в середине февраля, согласно информации от источников, знакомых с действиями компании. Внутренние тесты показали, что V4 превосходит модели Claude от Anthropic и серию GPT от OpenAI в области программирования. Она также демонстрирует значительные достижения в работе с длинными промптами, что может быть полезно разработчикам сложных проектов.

Выпуск V4 совпадет с праздничными каникулами в Китае, что напоминает тактику прошлого года, когда R1 была представлена за неделю до китайского Нового года. В то время модель привлекла внимание и негативно сказалась на акциях Nvidia.

Смена стратегии компании также заметна: в отличие от R1, ориентированной на математику, V4 будет фокусироваться на прикладном инжиниринге. DeepSeek стремится занять свою нишу на корпоративном рынке, где качество кода имеет прямое значение для прибыли.

Главный вопрос – сохранит ли V4 открытые веса. Если да, это может значительно повлиять на рынок, предоставив бесплатную модель, пишущую код лучше, чем платные аналоги.