DeepSeek избавляется от зоопарка моделей

DeepSeek выпустила новую модель V4.1 Flash. Нейминг, конечно, специфический и ничего экстраординарного не обещает, но модель меж тем важная. Компания убрала разделение между Instant, Expert и Vision режимами. Теперь одна модель сама решает, сколько времени потратить на ответ, умеет рассуждать над сложными задачами и работает с изображениями, снимая с пользователя необходимость выбирать что-то вручную.
Это MoE-модель с 552 миллиардами параметров и контекстом до миллиона токенов. DeepSeek утверждает, что новая модель Flash по производительности, скорости, стоимости и времени выполнения превосходит даже прежнюю Pro, хотя в отдельных тестах та всё ещё впереди.
Вместо зоопарка отдельных моделей компания постепенно превращает выбор режима в настройку одной и той же модели. Здесь DeepSeek догоняет конкурентов, потому как по подобной схеме давно работают практически все американские, да и большая часть китайских компаний. Однако сам подход иллюстрирует, что компания меняет подход и начинает больше думать о создании универсального пользовательского продукта, а не только о самих базовых моделях.