DeepSeek опубликовала веса экспериментальной модели DeepSeek-V4-Flash-Vision-Exp с 305 млрд параметров и расширила семейство V4-Flash до мультимодального режима. В документации компании модель описана как система, которая работает с изображениями вместе с текстом и подходит для скриншотов, графиков и других визуальных данных.
Такой формат нужен там, где смысл лежит не только в тексте, но и в структуре экрана, подписи на схеме или числе в отчете. Мультимодальная модель помогает извлекать данные из интерфейсов, документов и графиков, когда обычная текстовая обработка уже не видит весь контекст.
DeepSeek указывает для этой модели экспериментальный статус, а значит, речь идет о раннем релизе семейства. Это ограничивает выводы о готовности к промышленному использованию, но не меняет сам факт: V4-Flash получила визуальный модуль и стала работать с текстом и изображениями в одном режиме.