Китайский стартап DeepSeek анонсирует новую модель V4
Китайский стартап DeepSeek планирует представить свою флагманскую модель V4 в середине февраля, согласно информации, полученной от двух источников, знакомых с планами компании. По итогам внутренних тестов новая модель превзошла Claude от Anthropic и серию GPT от OpenAI в области программирования. V4 также продемонстрировала значительные успехи в обработке длинных промптов с кодом, что может оказаться полезным для разработчиков сложных проектов.
Релиз модели запланирован на 17 февраля, что совпадает с началом праздничных каникул в Китае и повторяет стратегию, использованную год назад при выходе R1. В прошлом году этот запуск привел к резкому падению акций Nvidia на $600 миллиардов за один день.
Новая модель отражает изменение стратегии DeepSeek: если R1 фокусировалась на логике и математике, то V4 будет ориентирована на прикладной инжиниринг. В настоящее время лидером по бенчмарку SWE-bench Verified является Claude Opus 4.5, и для достижения успеха V4 необходимо продемонстрировать не только высокое качество генерации кода, но и способности в отладке и работе с репозиториями.
Перед анонсом DeepSeek увеличила техническую документацию по R1 на 60 страниц, подтвердив, что некоторые методы, такие как Monte Carlo Tree Search, не сработали для задач общего рассуждения. Главный вопрос заключается в том, сохранит ли V4 открытый формат весов, что могло бы значительно повлиять на бизнес-модель закрытых лабораторий.