СРОЧНО:Новые смартфоны и технологии — в ленте TehnoRexВсе новости →
НОВОСТИ

DeepSeek V4.1 Flash: 552 млрд параметров, зрение и контекст до 1 млн токенов

DeepSeek официально представила V4.1 Flash: 552 млрд параметров, нативная мультимодальность, контекст до 1 млн токенов и заметно сниженные цены API. Модель V4 Pro выводится из эксплуатации.

DeepSeek V4.1 Flash: 552 млрд параметров, зрение и контекст до 1 млн токенов
Поделиться
Содержание 4
  1. 01Архитектура и масштаб
  2. 02Почему это дешевле
  3. 03Зрение и мультимодальность
  4. 04Что будет с V4 Pro

DeepSeek официально раскрыла характеристики своей новой модели V4.1 Flash — той самой, что вышла несколько дней назад и вызвала много вопросов из-за скудного официального описания. Теперь опубликованы технические детали, и они объясняют, почему компания так уверенно заявляла о превосходстве новинки над прошлым флагманом.

Архитектура и масштаб

V4.1 Flash построена на смеси экспертов: 552 млрд параметров, из которых активны лишь часть — примерно 8 млрд на входе и 16 млрд на выходе. Асимметрия необычная, но объяснимая: обработка запроса и генерация ответа требуют разного объёма вычислений. Использована новая архитектура с разделением на кодировщик и декодировщик, а обучение включало большой этап подкрепления. Контекст заявлен до одного миллиона токенов, а максимальная длина ответа — до 384 тысяч токенов.

Почему это дешевле

Отдельно подчёркивается экономия памяти: кэш длинных контекстов занимает примерно вчетверо меньше памяти и в восемь раз меньше места на накопителях, чем у предыдущего поколения. Для практики это означает, что длинные тексты и многошаговые агентские сценарии становятся ощутимо доступнее — именно на них раньше уходила основная часть бюджета. Цены API снижены: попадание в кэш подешевело примерно на 60%, вход — на треть, выход — немногим более 10%. В пиковые часы тарифы вдвое выше.

Зрение и мультимодальность

Модель нативная мультимодальная: она понимает изображения, распознаёт текст на скриншотах и анализирует графики. Картинку можно передать ссылкой, в виде данных или через файловый API. Раньше у DeepSeek для этого существовала отдельная экспериментальная сборка с внешним кодировщиком — теперь зрение встроено в базовую архитектуру, и отдельная модель больше не нужна.

Что будет с V4 Pro

Ключевое практическое изменение: с 14 сентября все запросы к V4 Pro будут направляться на V4.1 Flash и тарифицироваться по его ценам — до выхода V4.1 Pro. Старые интеграции при этом не сломаются, поскольку имена моделей маршрутизируются автоматически. Для разработчиков это означает, что платить за прежний флагманский уровень больше не нужно, а длинные контексты с кэшированием станут заметно дешевле. В Беларуси API DeepSeek доступен, так что изменения затрагивают и местных разработчиков.

По теме: V4.1 Flash: первый анонс, DeepSeek V4.1 Pro: сроки, США и китайские ИИ-компании.

Текст TehnoRex. Дата: 2026-09-10.