Китайский стартап DeepSeek намерен выпустить свою новую флагманскую модель V4 в середине февраля, как сообщает The Information, ссылаясь на информированные источники. По итогам внутренних испытаний, V4 демонстрирует превосходство над Claude от Anthropic и серией GPT от OpenAI в задачах программирования. Особенно стоит отметить, что новая модель способна эффективно обрабатывать длинные промпты с кодом, что может стать значительным преимуществом для разработчиков сложных проектов.
Выпуск V4 запланирован на 17 февраля, совпадая с праздниками в Китае, что повторяет стратегию, использованную при запуске R1 в прошлом году. Тогда эта модель привлекла внимание технологического сообщества, вызвав резкое падение акций Nvidia на $600 миллиардов за один день.
Смена стратегии также заметна: если R1 была нацелена на «чистое рассуждение», то V4 ориентируется на прикладной инжиниринг, что подразумевает стремление компании к корпоративному рынку. Среди новинок — расширенная документация по R1, которая включает 60 страниц о процессе обучения. Грядущая интрига заключается в том, сохранит ли V4 формат открытых весов, что может подорвать бизнес-модели закрытых лабораторий, предлагая бесплатное решение, способное генерировать код лучше коммерческих аналогов.