Новости

DeepSeek V4 претендует на лидерство над Claude и GPT в кодинге

Китайская компания DeepSeek намерена представить свою флагманскую модель V4 в середине февраля. Об этом сообщает The Information со ссылкой на источники, знакомые с планами стартапа. Согласно внутренним тестам, новая модель показывает лучшие результаты в программировании, чем Claude от Anthropic и линейка GPT от OpenAI, а также заметно лучше работает с очень длинными кодовыми запросами — что особенно важно для сложных инженерных задач.

Выбор даты релиза повторяет прошлогодний сценарий: в январе DeepSeek выпустила модель R1 незадолго до китайского Нового года, что тогда вызвало резонанс в индустрии и привело к резкому падению капитализации Nvidia. V4 планируют анонсировать около 17 февраля, накануне праздничных каникул в Китае.

V4 отражает изменение фокуса компании. Если R1 была ориентирована на абстрактные рассуждения, математику и логику, то новая модель делает упор на практическую разработку и прикладной инжиниринг. DeepSeek нацеливается на корпоративный сегмент, где качество автогенерации кода напрямую влияет на бизнес-результаты. Сейчас лидерство в бенчмарке SWE-bench Verified удерживает Claude Opus 4.5 с показателем 80,9%, и для выхода в лидеры V4 потребуется продемонстрировать не только сильную генерацию кода, но и полноценные агентные навыки — от отладки до работы с репозиториями.

Накануне анонса компания также существенно расширила техническую документацию по модели R1, подробно описав весь процесс обучения. В частности, DeepSeek признала, что такие популярные методы reinforcement learning, как Monte Carlo Tree Search и Process Reward Model, оказались неэффективными для задач общего рассуждения из-за слишком грубой «гранулярности» шагов: они хорошо работают в формальных доменах вроде шахмат, но плохо масштабируются на открытые задачи.

Главный вопрос — останется ли V4 бесплатной моделью. В таком случае ее успех может серьезно ударить по позициям платных коммерческих ИИ-лабораторий и сделать модели доступнее. Что не может нас не радовать.