DeepSeek объявила о выпуске V4.1-Flash — новой модели с нативным пониманием изображений. Компания описывает её как младшую модель семейства с архитектурой MoE на 552 млрд параметров: при предварительной обработке каждого токена активны 8 млрд параметров, при декодировании — 16 млрд. По данным DeepSeek, KV-кэш требует в четыре раза меньше HBM и в восемь раз меньше SSD, чем у предыдущего поколения. Модель уже доступна в API под именем deepseek-flash; прежние идентификаторы V4-Flash и V4-Flash-Vision-Exp временно направляют запросы на неё. Новые цены действуют с 04:00 UTC 10 сентября. DeepSeek отдельно предупреждает: с 14 сентября запросы к deepseek-v4-pro будут маршрутизироваться на V4.1-Flash по её тарифам. Заявленные сравнения производительности принадлежат самой компании.