🤖 DeepSeek выпустила V4.1 Flash
10 сентября DeepSeek представила наименьшую модель новой линейки с нативным пониманием изображений: MoE на 552B параметров, Causal Encoder–Decoder с 8B активных параметров на входе и 16B на выходе, контекст до 1M токенов. KV-кэш занимает в 4 раза меньше HBM и в 8 раз меньше SSD, чем у прошлого поколения.
🌍 В DeepSeek API она доступна как deepseek-flash и вытесняет флагман: с 04:00 UTC 14 сентября все запросы deepseek-v4-pro уходят на неё до выхода V4.1-Pro. Off-peak-цены вдвое ниже пиковых, веса открыты на Hugging Face, есть vLLM-рецепт для self-host.
👤 Одна модель ведёт диалог, разбирает картинки и сама включает зрение — вручную выбирать режим больше не нужно. Старые deepseek-v4-flash и deepseek-v4-flash-vision-exp временно маршрутизируются на неё.
Источник 1: https://www.deepseek.com/en/news/deepseek-v4-1-flash/
Источник 2: https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash
